北京系统运维经理
系统运维经理负责管理和协调组织内部的系统运维团队,确保系统的稳定运行和维护。他们负责规划、部署和维护公司的硬件、软件和网络基础设施,以及监控系统性能和安全性。此外,该职位还需要与其他部门合作,确保系统满足业务需求,并制定系统升级和维护计划。系统运维经理还需要处理故障和紧急情况,制定解决方案并协调团队解决问题。他们还负责监督团队成员的工作,进行绩效评估和培训,以确保团队高效运作。这个职位需要对系统架构和运维流程有深入理解,以及出色的领导和沟通能力。
薪酬概览
平均月薪
¥10800
中位数 ¥0 | 区间 ¥9200 - ¥12300
数据来源:样本数量过少,仅供参考;更新时间:2026年7月13日
月薪分布
55.6% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
6月新增岗位
4
对比上月:岗位减少4
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 4 | 50% |
| >10年 | 4 | 50% |
热招职位
Cloud LLM Agent 系统研发工程师【2027届校招】
关于我们
我们致力于构建新一代大模型系统基础设施,让大模型不仅能“对话”,而是能够在真实业务和自动驾驶研发场景中稳定运行、可控执行并持续进化。
本方向聚焦云端 LLM Agent 系统、工具调用、工作流编排、多 Agent 协同和生产级 Agent Infra,强调工程能力、系统设计能力和面向真实业务场景的稳定落地能力。
岗位职责
作为 Cloud LLM Agent 系统研发工程师,你将参与构建面向真实业务场景的云端 Agent 基础设施,主要工作包括:
参与构建云端 LLM Agent 系统,包括工具调用、任务执行、工作流编排和多 Agent 协同能力。
设计和实现 Agent 执行框架,包括状态管理、任务调度、上下文管理、记忆机制和执行恢复。
对接内部系统、研发工具链和数据平台,建设自动化任务执行能力。
优化 Agent 系统的稳定性、延迟、成本和可观测性,支持生产环境持续运行。
建设 Agent 评测、回归测试、badcase 分析和效果迭代体系。
与模型训练和端侧部署团队协作,推动 Agent 场景下的模型能力优化和工程闭环。
任职要求
计算机相关专业本科及以上学历
扎实的计算机基础,包括数据结构、操作系统、网络、分布式系统等。
熟悉至少一种编程语言(Python / Go / Java / C++)。
对大模型、Agent 系统或 AI 应用工程有基本了解或强兴趣。
具备良好的工程动手能力、问题定位能力和系统设计意识。
能阅读英文技术文档。
加分项(非必须)
有 LLM Agent、RAG、工具调用、工作流引擎或自动化系统项目经验。
熟悉 LangChain、LlamaIndex、AutoGen、OpenAI / Anthropic / LiteLLM 等相关框架或 API。
熟悉 Kubernetes / Docker / Linux 环境,有服务端系统开发经验。
有异步任务调度、状态机、消息队列、事件系统或分布式系统经验。
有模型评测、prompt engineering、上下文压缩、记忆系统或 Agent 安全控制经验。
有开源项目或工程实践经验。
我们提供的成长机会:
深度参与生产级 Cloud LLM Agent 系统从框架设计、工具接入到线上运行的完整工程链路。接触真实业务和自动驾驶研发场景中的 Agent 落地问题。建立大模型应用系统在稳定性、可观测性、成本和效果迭代上的系统化经验。与训练、部署和业务团队协作,理解 AI Agent 从 demo 到 production 的关键工程挑战。
负责手机、平板、机器人等终端产品的磁性能相关问题的建模和仿真能力构建工作:
1. 负责产品磁性能问题仿真方法/精度/优化/效率提升方面的研究;
2. 参与产品磁性能问题的定位,根因分析以及改进措施建议;
3. 负责新型磁性能仿真技术的洞察、规划、开发和产品问题应用;
负责手机、平板、机器人等终端产品中电机或运动部件控制类仿真能力构建工作:
1. 负责产品电机性能或运动部件控制类仿真方法/精度/优化/效率提升方面的研究;
2. 负责或参与电机、电控仿真方法的产品应用落地和项目问题解决;
3. 负责或参与行业电机或运动部件控制类仿真技术的洞察、规划和探索研究工作;
1、人形/四足狗/灵巧手等形态整机结构设计及开发:
(1)负责机器人本体结构设计和开发工作,负责整机堆叠设计、结构件设计、可靠性设计、轻量化设计、组装工艺设计、可维修性设计;
(2)负责机器人运动机构设计,结合生物力学原理优化机构设计方案,进行动力学建模与性能验证,解决运动控制中的耦合问题;
(3)负责结构件的交付工作;
2、关节模组设计及开发:
(1)减速器(行星、谐波、摆线等形式)设计开发;
(2)无框力矩电机、空心杯电机等设计和开发。
1. 承担系统/子系统/复杂模块的验证交付工作,搭建CT/BT环境。对现有系统验证方案进行综合评估,提出改进和优化;
2. 针对模块各种复杂应用场景,开发和实现不同验证组件,帮助设计人员高效定位和解决问题;
3. 根据编译器内核指令开发随机约束验证环境,撰写功能覆盖率文件,测试各种极端指令场景;
4. 与架构工程师紧密配合,运用各种技术全面分析芯片功耗/性能数据,优化芯片PPA技术指标;
5. 开发针对车规芯片FuSa (Functional Safety)功能的验证环境,并使用Z01X工具进行功能验证;
6. 引入和使用系统建模/ 静态仿真/ 原型验证等多种手段,延长验证生命周期,提高验证可信度;
7. 进一步规范系统验证流程,明确验证交付标准,全面提升验证与前后端技术人员的交互效率;
1、负责企业整体信息安全管理体系规划、搭建与落地。覆盖网络安全、数据安全、应用安全、终端安全、物理安全、运维安全等领域。
2、统筹安全制度、策略、规范、操作流程的编制、发布与迭代;开展常态化合规自查、风险评估、差距分析,输出整改方案,确保业务、系统、人员全维度满足监管及行业合规要求;
3、监管合规:应对监管检查、现场测评、专项核查材料筹备与对接。
主导 ISO27001、等保
2.0/3.
0、个人信息保护、数据安全法、网络安全法等合规体系建设、落地与持续优化。
4、客户审查:对接外部客户信息安全审查要求,完成基于IOS 27001和TISAX标准的供应商资质审查,以及项目合同审查。
5、定期开展全网安全风险评估、渗透测试、漏洞管理、供应链安全、第三方外包安全管控;识别业务场景安全风险,输出风险清单、整改要求、闭环追踪。
1. 项目售前支持,包括技术方案展示需求沟通、定义及管理;
2. 项目整体方案设计 ,对外技术沟通 ;
3. 负责对子系统的工作产品进行审核;
4. 组织及主持项目内部 /外部 技术例会;
5. 负责台架测试、整车调试;
6. 处理产品试验、售后相关问题 以及工程经验积累;
7. 主要方向包括:
✓ 电机驱动方向
✓ 开关电源方向
1. Provide everyday wind technicques and providing wind resource consultation service for all GWI departments.
为GWI各部门提供日常风电技术和风电资源咨询服务
2. Compile reports on sales and wind resource analysis and model-selection.
编制销售报告和风能资源分析及选型报告。
3. Investigate the the wind power sites and compile investigation reports
对风电站点进行调查,编写调查报告
4. "Conduct the microcosmic and spot location-selecting; Compile reports and participate in the appraisal of plans.
进行微观和现场的选址;编写报告,参与计划评审
5. Organize the Guidline management
组织指导方针的管理
6. Organize wind power research and compile research reports
组织风电研究,编写研究报告
7. Collect the market information and technical demand; Provide feedback to directors of departments and information administrator.
收集市场信息和技术需求;反馈给部门主管和信息管理员
8. Provide PC guarantee work,including PC document compile,biding support,investigate the related items of TSA contract
提供PC保障工作,包括PC文件的编写,投标支持,调查TSA合同的相关项目
9. Provide post evaluaiton of Exiting wind farm,PC test assistant
提供现有风电场的后评估,PC测试助理
10. Complete other tasks assigned by Director or the company
完成交办的其他任务
1.Linux GPU服务器运维管理:负责多台Linux操作系统(Ubuntu)服务器的GPU、磁盘存储等资源的监控、维护、优化与故障排除,协调GPU训练资源,进行基础的系统配置、用户管理、权限控制。
2.平台环境部署与维护:使用容器化技术(Docker)进行开发环境的打包、部署和管理,了解并协助维护基于Kubernetes的容器编排平台,部署、配置和维护数据平台运行的关键基础服务,开发提升数据平台运行效率的流程脚本工具。
3.问题诊断与解决:快速响应和诊断系统或平台故障,包括硬件、网络、存储以及基础服务问题。
4.AI模型训练效率优化:优化各项训练任务的GPU利用率,训练效率
1.负责大型企业网络架构的全流程运维,熟练管理基础网络架构,包括路由器、交换机的日常配置、巡检与维护,保障网络架构稳定运行。
2. 负责防火墙策略的开通、梳理与规范化管理,合理配置安全策略,防范网络安全风险,配合落实网络安全相关工作。
3. 能够独立部署大型集群型网络架构,结合企业需求合理规划大型集团公司网络架构,兼顾网络稳定性、高效性与安全性;掌握高可用网络架构的部署与维护方法。
4. 负责上网行为管理AC设备的日常管理与配置,规范员工上网行为,保障网络带宽合理利用与网络安全。
5. 熟悉桌面终端管理,负责企业员工桌面终端(Windows、Linux系统)的日常运维,熟练处理系统卡顿、软件异常、驱动故障等常见问题。
6. 负责打印机等办公外设的安装、调试与维护,快速排查打印异常、设备故障等问题,保障办公外设正常运转。
7. 精通终端管控软件的使用,落实终端安全管理要求,包括终端防病毒、补丁更新、权限管控等,防范终端安全风险。
8. 精通Zabbix监控系统的建立、部署、配置与维护,搭建全面的网络、终端、设备监控体系。
9.. 负责网络状态、终端运行状态、设备负载等的实时监控,及时发现异常并预警,快速响应处置,负责日常与各厂商的对接实施工作。
10. 具备快速定位与解决复合型故障的能力,包括但不限于网络、云计算、网络安全相关故障,降低业务中断风险。
11. 熟悉云计算平台的工作原理及应用系统架构原理和拓扑,了解相关网络安全性,能配合完成云计算相关运维支撑工作。
12. 负责网络、桌面、监控相关运维日志的记录、整理与归档,定期总结运维经验,优化运维方案。
13.领导交办的其他事项。
1.负责智驾平台计算服务日常运维工作,包括健康巡检、发布变更、监控完善、SOP、OnCall响应、故障处理等
2.负责智驾平台计算服务生产保障工作,包括需求处理、集群建设、资源交付、资源管理、测试验证等
3.参与智驾平台计算服务整体建设工作,包括K8S混合云服务、计算应用、多种类GPU/CPU等资源服务的自动化能力建设、成本管控和稳定性保障等
任职要求


