朝阳Service Engineer
Service Engineer是指负责在客户的现场安装、调试、维护和维修公司的产品或设备的工程师。他们需要对公司的产品或设备非常熟悉,能够及时解决客户遇到的问题,并确保产品或设备能够正常运行。此外,Service Engineer还需要与客户保持良好的沟通,及时了解客户的需求和反馈,为客户提供专业的技术支持和维护服务。这个岗位需要具备良好的技术能力、沟通能力和问题解决能力。
薪酬概览
平均月薪
¥6800
中位数 ¥6500 | 区间 ¥4800 - ¥8700
数据来源:样本数量过少,仅供参考;更新时间:2026年7月13日
月薪分布
71.4% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
12月新增岗位
21
对比上月:岗位新增9
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 不限经验 | 21 | 100% |
热招职位
岗位核心价值
负责公司大算力 AI 集群(含 B/H 系列高端卡、国产算力卡)的架构设计、搭建部署、运维优化与国产化适配,支撑大模型训练、自动驾驶等核心业务的高效稳定运行,打造高可用、高性价比的算力基础设施。
核心工作职责
1. 大算力集群自建与架构设计:主导超大规模 AI 算力集群(数千 P 级)的自建规划,包括硬件选型(GPU/B/H 系列卡、国产卡等)、网络拓扑设计(InfiniBand/ROCE)、存储架构(分布式存储)、集群调度系统搭建,确保集群性能达标、扩展性强。
2. 高端 GPU 加速与优化:具备 NVIDIA B 系列、H 系列高端算力卡的实战经验,负责卡级性能调优、并行计算加速(TensorRT/MPI/NCCL)、显存优化,解决大模型训练 / 推理中的算力瓶颈问题。
3. 国产算力卡适配落地:主导国产算力卡(阿里PPU、华为昇腾等)的适配工作,包括驱动安装、框架适配(TensorFlow/PyTorch/MindSpore)、模型迁移与性能调优,实现国产算力与业务场景的深度融合。
4. 集群运维与稳定性保障:负责算力集群的日常运维,包括硬件故障排查、集群监控告警(GPU / 网络 / 存储状态)、资源调度优化、灾备方案设计,保障集群全年高可用性(99.9% 以上)。
5. 技术沉淀与迭代:跟进业界大算力集群技术趋势(如新型 GPU、网络协议、调度系统),输出技术方案与最佳实践;搭建集群运维自动化工具,提升运维效率。
1、对部署效率负责,对相关工具的建设负责,实现多产品组合一键部署,无人值守安装,落地基于不可变基础设施的部署方案;
2、负责运维体系建设,包括可观测性体系,北极星指标体系,CMDB,工单系统,作业平台等;
3、参与制定SRE相关的规范和流程,并负责推广落地;
4、负责SRE团队技能建设,团队技术分享、团队技术选型、团队技术培训等;
5、作为团队技术专家,负责解决重大疑难问题,团队知识库建设,故障复盘,常见问题沉淀,预案体系建设,混沌工程建设。
1. 协助运维人员进行服务器、网络设备、存储设备等设备的日常运维工作,并及时处理出现的问题;
2. 协助运维人员编写文档,记录相应的操作流程、日常工作和服务器的维护情况等;
3. 参与服务器应用的安装、维护和升级工作,通过对生产环境进行技术测试和排查异常,为公司IT系统的稳定运行做好技术支持;
4. 参与公司IT系统的监控、数据备份等工作,及时处理并防止系统出现故障。
工作内容:
1、负责日常资源交付、变更、巡检、告警处置与故障恢复工作,沉淀输出标准化操作流程;
2、参与可观测体系、容量管理、混沌工程、流量调度等方向的平台与体系持续优化演进;
3、主导基于大语言模型(LLM)的运维智能体(AI Agent)、AI工作流方案设计,落地运维数字人、AI巡检、AI根因分析等AIOps业务场景。
任职资格:
1、本科及以上学历,拥有3年及以上AI开发或运维相关工作经验;
2、熟练掌握Python/Go至少一门编程语言者优先;
3、熟悉Linux操作系统,了解Kubernetes(K8s)基础概念;熟练使用Prometheus、DNS、CDN、CICD、Nginx等常用中间件与服务,具备传统运维故障排查、自动化脚本编写实操能力;
4、了解可观测、容量管理、高可用容灾架构、混沌工程、流量调度相关知识,拥有大规模集群稳定性保障实战经验优先;
5、熟悉LangChain、LangGraph、Dify等主流Agent开发框架,掌握MCP、技能插件(Skills)、Prompt&RAP、多智能体规划相关技术;
6、具备优秀的问题拆解、逻辑分析、跨团队沟通协作能力,学习主动性强、自驱力突出。
工作内容:
1、负责日常资源交付、变更、巡检、告警处置与故障恢复工作,沉淀输出标准化操作流程;
2、参与可观测体系、容量管理、混沌工程、流量调度等方向的平台与体系持续优化演进;
3、主导基于大语言模型(LLM)的运维智能体(AI Agent)、AI工作流方案设计,落地运维数字人、AI巡检、AI根因分析等AIOps业务场景。
任职资格:
1、本科及以上学历,拥有3年及以上AI开发或运维相关工作经验;
2、熟练掌握Python/Go至少一门编程语言者优先;
3、熟悉Linux操作系统,了解Kubernetes(K8s)基础概念;熟练使用Prometheus、DNS、CDN、CICD、Nginx等常用中间件与服务,具备传统运维故障排查、自动化脚本编写实操能力;
4、了解可观测、容量管理、高可用容灾架构、混沌工程、流量调度相关知识,拥有大规模集群稳定性保障实战经验优先;
5、熟悉LangChain、LangGraph、Dify等主流Agent开发框架,掌握MCP、技能插件(Skills)、Prompt&RAP、多智能体规划相关技术;
6、具备优秀的问题拆解、逻辑分析、跨团队沟通协作能力,学习主动性强、自驱力突出。
1、支持行业云平台和云产品在不同芯片架构和服务器下适配的技术方案,推动多部门协同,解决软硬件技术问题,向用户提供自主可控,安全可信的行业云平台。
2、推动行业云横向架构治理,支持特定云产品线的多芯架构升级,包括安全合规、资源共池等,以满足各类行业标准和规范。
3、推动云产品在不同芯片体系下的性能调优和应用迁移技术方案,实现行业云平台的平滑迁移。
1、负责公司网络及系统实施和运维;
2、负责各类业务变更及应急故障响应处理;
3、根据业务需求,规划设计系统架构;
4、数据中心机房建设及弱电建设。
职位要求:
1、硕士(含)及以上学历,计算机、电子通讯等相关专业;
2、3年以上制造行业经验,并主导重大项目实施落地(需要有实操案例);
3、精通熟练SDWAN、SDN等主流技术并可以应用到工作;
4、对网络、系统存储、网络安全、桌面运维、弱电等运营领域有浓厚的兴趣并致力于相关领域发展;
5、吃苦耐劳,能够承受较强的抗压能力,并能自我驱动进行持续学习,具备良好的沟通能力;
6、积极主动,具有良好的大局观和运维服意识;
7、拥有CCIE或MCSE相关认证优先;
8、语言要求:英语六级/雅思/托福,英语口语优者优先录用;
9、工作地点:东莞塘厦
1. 负责超大规模大数据平台及 AI平台的稳定性保障,围绕监控告警、故障诊断、容量水位、链路治理、变更风险、应急处置和复盘改进等场景,持续提升系统可靠性。
2. 负责生产环境部署、发布、扩缩容、迁移等关键场景的稳定性保障,沉淀交付与运营的标准化方案。
3. 负责支持客户业务平稳迁移方案设计、适配、风险评估,在迁移关键节点提供稳定性兜底。
4. 参与智能运维 Agent建设,结合大模型、RAG、工具调用、自动化编排和知识库能力,落地日志分
析、指标分析、故障归因、异常检测、根因定位、SOP 执行和运维问答等AI化运维能力。
负责政企专有云平台的安全体系建设与日常运营,统筹云内安全产品运维、云外安全设备管理及合规评测全流程,保障平台安全稳定运行。该岗位需驻场客户现场,作为平台安全的第一责任人,在高压环境下独立推进安全运营工作,并通过业务梳理与AI工具应用持续提升安全运营效率。
一、云平台安全产品运营
负责云平台内置安全产品的部署、配置、策略优化及日常运维,包括但不限于云盾(DDoS防护/主机安全)、Web应用防火墙(WAF)、安骑士(主机入侵检测与基线核查)、加密机(密钥管理与数据加密服务)等。定期审视安全策略有效性,结合业务变化动态调整防护规则,确保安全能力与业务需求匹配。对安全告警进行分级处置,建立从告警发现、研判分析到闭环处置的标准化流程,持续降低误报率并提升威胁响应时效。
二、云外安全设备管理
负责传统安全设备的运维与策略管理,包括下一代防火墙四至七层访问控制规则的规划、配置与审计,IPS/IDS入侵防御系统的特征库更新与自定义规则调优,API安全网关的检测策略配置与异常流量分析等。定期开展安全设备健康巡检与性能评估,推动老旧设备迭代替换方案落地。配合网络团队完成安全域划分、边界隔离及跨域访问管控,确保纵深防御体系完整有效。
三、大型系统与网络安全维护
承担平台整体安全架构的日常维护与应急响应,覆盖操作系统加固、中间件安全配置、数据库访问审计、容器运行时安全等多个层面。参与重大变更的安全评审,对高风险操作制定回退预案并全程监护。主导或参与安全事件的调查溯源,输出根因分析报告并推动整改措施落地。建立安全知识库与应急预案体系,定期组织攻防演练与安全培训,提升团队整体安全实战能力。
四、合规评测全流程支撑
作为平台侧合规对接人,统筹推进等级保护测评(三级及以上)、商用密码应用安全性评估(密评)、安全审计评测等合规认证工作。熟悉各类评测的标准要求、测评流程及材料准备规范,能够独立完成差距分析、整改方案制定、证据材料整理及现场测评配合。推动合规检查项的自动化采集与归档能力建设,将周期性合规验证从人工逐项核对升级为系统化、可持续的自动化合规运营。
五、AI驱动的安全运营提效
主动梳理安全运营中的重复性、高耗时业务场景(如告警研判、日志分析、合规材料生成、策略巡检等),沉淀为可结构化的业务知识。探索并落地AI工具在安全运营中的应用,例如利用大模型辅助告警分类与威胁情报关联分析、自动生成合规报告初稿、智能化策略推荐等,切实提升个人及团队的工作效能。持续关注AI安全领域的新技术与新方法,推动安全运营能力的持续进化。
1.设备检修维护管理1.1 负责检修策划书等计划内容、重要消缺工作的执行监督,严格按照检修策划书、测试方案进行检修工作,并签字确认;检修中发现的设备缺陷及时或不能立即处理的在EAM系统对应工单的完工报告对应项中进行登记,并如实记录入检修台账;
1.2 协同班长、副班长、专工,负责检修的过程验收及最终验收工作,汇总检修记录、缺陷记录,并按要求及时于EAM工单管理中上传检修清单、重点部位巡视表、检测报告等。
2.故障、缺陷管理2.1 对于A类缺陷,发现后立即向班长、副班长汇报,对于危及人身或设备安全的A类缺陷立即现场采取紧急处置;
2.2 对于B类缺陷负责在7日内主动向班长申请完成消缺,如不能及时消除则应列入下月消缺计划;
2.3 对C类缺陷负责依据具体情况安排进入月度消缺计划,一般不应超过2个月。
3. 技术监督管理3.1 负责班组年度技术监督计划的有序开展,并对外包的检测项目质量实施全过程监督;
3.2 负责检查检测报告的录入,保证检测报告均已上传EAM系统对应工单检修检测数据报告中;
3.3 参与检测报告总结会议,依据检测结果根据检测结果及现场实际情况,提出合理的、可行的解决(预防)方案;
3.4 负责检测异常整改计划的执行并参与整改效果的评价及验收。
4.技术改造及监督管理4.1 负责检修基地技术改造工作的实施及过程、质量监督;
4.2 负责协助专工开展技改验收和效果评价工作。
5.设备异动管理5.1 协助班长、副班长负责向集控运行提出设备异动申请单,并说明其必要性;
5.2 负责执行设备异动工作;
5.3 负责修改设备台账,做好班组设备异动统计。
6.设备停复役管理6.1 负责向集控运行提交符合要求的停运申请表;
6.2 设备提前复役的,需提前1小时电话告知集控运行;
6.3 设备复役后现场应告知集控运行设备运行注意要求,尤其是一些大部件修复、更换后。
7.风电场保护定值、控制逻辑管理7.1 负责在保护定值及控制逻辑变动前,执行OA“保护定值、控制逻辑变更”申请流程;
7.2 负责在保护定值或控制逻辑修改、异动、退出等工作执行时,遵守公司安全相关管理规定要求,并履行工作票手续。
8.设备分析管理8.1 对责任风机运行情况进行分析总结,参加检修基地月度设备分析会议,对异常机组提出可行的改进措施,并负责督促落实。
9.相关方管理9.1 关于所负责的项目,开工前对承包方的资质条件及“三措两案”等资料进行汇总初审后报EHS专工进行审核;
9.2 在OA上提交相关方开工手续的申请;
9.3 工作负责人在作业前对相关方工作面的危险点分析与预控措施的交待;
9.4 监督检查相关方“三措两案”落实情况,如有违反安全管理规定、安全技术措施不落实的情况,应现场给予指正,拒不整改者应向班长、副班长或 EHS 专工汇报,并对整改情况进行检查。
11.安全生产全过程监督管理11.1 人员隐患的自查与检查:操作人员自觉执行操作规程和应急处置技能情况;接受安全技能培训、安全教育、持证上岗、劳动保护情况;
11.2 设备隐患的检查:风机、箱变、集电线路等重要生产区域的安全状况;齿轮箱、发电机、叶轮、塔筒等机组重要部件的安全状况;重大危险源及特种设备的安全状况;各类电动工器具、安全工器具的检验及使用状况;
11.3 检查风机或作业区域内粉尘、照明、噪音、气味、辐射、高温、低温、毒物等影响人员健康的环境状况;
11.4 检查风机或作业区域内现场沟坑孔洞、平台栏杆步道等影响人员作业安全的设施状况;
11.5 检查设备检修作业、动火作业、进入受限空间作业、起重作业、高处作业、高边坡作业、临时用电等作业的危险点预控情况;
11.6 检查各类安全警示标志的管理和设置情况。
负责优化前沿三维重建(如神经辐射场、高斯泼溅等技术体系)数据链路,提升数据链路自动化程度、稳定性、处理效率和吞吐量;将三维重建技术应用于自动驾驶的数据合成、仿真环境构建、高精地图生成以及场景理解等领域,为自动驾驶的研发与测试提供核心工具与数据支撑;跟进学术界与工业界最新进展,能够将创新技术进行工程化落地,并与感知、规划、仿真等团队协作,推动技术方案在实际业务中的部署与应用。
职位要求
计算机科学、自动化、数学、机器人等相关专业硕士及以上学历,或具备同等水平的实践经验;出色的编程能力,熟练掌握Python和C++,代码风格良好,注重工程规范与算法性能优化;对三维重建数据链路有扎实的理论基础与实践经验,熟悉其主流算法框架与技术脉络;具备优秀的数学功底,包括但不限于线性代数、概率统计、数值优化与几何计算;强烈的自驱力、求知欲和解决问题的能力,能够在开放的研究与工程问题上进行有效探索。
加分项
具备大规模真实场景(如街景、城市场景)三维重建或建模的实际项目经验;具备大规模车载传感器数据处理链路的实际项目经验;熟悉点云、图像、IMU、GPS等传感器数据处理;在权威算法竞赛(如Kaggle、ACM-ICPC、全国信息学奥赛等)中取得突出成绩;深度参与过知名三维视觉或计算机视觉开源项目的贡献,并有可验证的成果。
1、负责新产线/现有产线的布局规划、工艺流程设计及优化,确保质量、产能、效率、成本等目标达成;
2、运用工业工程(IE)方法(如精益生产、人机工程学)进行产线平衡分析,消除瓶颈工序;
3、设计自动化、数字化产线技术方案,集成智能制造设备(如机器人、AGV、MES系统等);
4、与DT/智造团队协作,实现产线规划系统与MES、WMS等系统的数据互通;
5、跟踪智能制造新技术(如数字孪生、柔性制造),推动创新落地。


