陇南Service Engineer
Service Engineer是指负责在客户的现场安装、调试、维护和维修公司的产品或设备的工程师。他们需要对公司的产品或设备非常熟悉,能够及时解决客户遇到的问题,并确保产品或设备能够正常运行。此外,Service Engineer还需要与客户保持良好的沟通,及时了解客户的需求和反馈,为客户提供专业的技术支持和维护服务。这个岗位需要具备良好的技术能力、沟通能力和问题解决能力。
薪酬概览
平均月薪
¥10600
中位数 ¥0 | 区间 ¥8200 - ¥13000
数据来源:样本数量过少,仅供参考;更新时间:2026年7月13日
月薪分布
80% 人群薪酬落在 8-15k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
8月新增岗位
15
对比上月:岗位新增7
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 7 | 43.8% |
| 3-5年 | 3 | 18.8% |
| 5-10年 | 3 | 18.8% |
| 不限经验 | 3 | 18.8% |
热招职位
岗位描述
我们正在招聘智能运维开发工程师,负责阿里云大数据平台的智能运维体系建设,面向超大规模大数据平台、AI 平台及相关基础设施,持续提升系统稳定性、运维效率和平台自动化能力。
该岗位将深度参与大数据平台运维平台开发、稳定性治理、AI 化改造和智能运维 Agent 建设,围绕故障发现、问题诊断、容量水位、变更风险、发布管控、监控告警、自动化处置等核心场景,建设面向超大规模复杂系统的智能化运维能力。
你将与研发、SRE、平台工程、算法和产品团队协作,推动传统运维能力向平台化、自动化、智能化演进,支撑阿里云大数据平台及 AI 平台在大规模、高复杂度、高可用要求下稳定运行。
工作职责
1. 负责阿里云大数据平台智能运维体系建设,参与运维平台、稳定性平台、自动化工具、诊断系统等核心能力的设计与开发,提升平台化、自动化和智能化运维水平。
2. 参与智能运维 Agent 建设,结合大模型、RAG、工具调用、自动化编排和知识库能力,落地日志分析、指标分析、故障归因、异常检测、根因定位、SOP 执行和运维问答等 AI 化运维能力。
3. 负责超大规模大数据平台及 AI 平台的稳定性保障,围绕监控告警、故障诊断、容量水位、链路治理、变更风险、应急处置和复盘改进等场景,持续提升系统可靠性。
4. 参与大数据平台架构演进和稳定性治理,识别系统瓶颈与稳定性风险,推动容量规划、性能优化、资源治理、容灾高可用和架构改进。
阿里云智能-运维开发-AIOps Agent工程师(售后技术方向)
我们正在招聘运维开发工程师,负责阿里云大数据&AI平台的售后智能答疑体系和客户体感稳定性体系建设,从用户服务专家的视角来处理超大规模大数据平台承载的用户问题和重保需求,持续提升运维效率,为产品稳定性和服务口碑树立持续贡献力量
该岗位以大数据&AI产品售后答疑工作为业务基础,一方面深度参与共建Agent架构下的智能答疑能力,围绕问题自助答疑、自助诊断和产品改进项提炼等核心场景进行自动化能力建设;另一方面深度参与客户体感稳定性体系和重保能力建设,在对产品架构和稳定性场景深入掌握的基础上,提炼客户实例级稳定性指标,为客户提供更前置的主动隐患发现与重保服务能力
你将与TAM、研发、SRE、平台工程、算法和产品团队协作,推动传统答疑和排查能力向智能化演进,支撑阿里云大数据&AI平台业务高速发展,共建业界一流的智能服务专家团队
工作职责:
1. 负责阿里云大数据&AI产品的售后L3答疑和服务工作,承接前方服务团队的升级工单处理和用户疑难问题排查;组织和提供大客户钉群服务能力,对头部/重要客户进行业务保障;接收客户需求提供业务巡检、大促护航、产品改进推动等重保能力交付
2. 参与基于Agent的智能答疑体系建设,结合大模型、RAG、Skills、Harness engineer等技术能力,落地根因定位、异常检测、SOP执行和运维问答等AI化运维能力
3. 参与客户体感稳定性系统建设,协同产研SRE建立实例级可用率指标,定义客户级体感可用率标准,构建细粒度封网、变更后置、主动巡检和风险发现预防等重保能力,推动客户问题发现与主动服务链路落地,为产品提供更强的增值能力
4. 负责售后支持外包团队的管理,包括答疑提效、人员培养和成本管理等职责
1. 中间件运维与高可用保障:负责消息队列(Kafka/RocketMQ)、服务注册与配置中心(Zookeeper/Nacos)等核心中间件的稳定性维护、性能调优及高可用架构设计;基于Kubernetes完成容器化部署、弹性扩缩容、版本升级及日常运维,保障核心系统7x24小时稳定运行。
2. 故障排查与根因分析:通过日志分析、链路追踪及监控体系快速定位中间件相关故障(如消息堆积、服务注册异常等),主导问题修复与复盘;使用Java或Go开发调试工具,高效排查线上性能瓶颈及与业务系统的兼容性问题。
3. 性能优化与平台适配:测试并优化中间件在不同CPU架构、内核版本及容器环境下的性能表现,解决资源调度与性能瓶颈问题,持续提升中间件运行效率与资源利用率。
4. 负责搭建及使用SRE数字人实现线上运维智能化。
运维工程师面议
1.负责CentOS/国产麒麟系统的服务器与云资源的全生命周期管理(部署、监控、调优、安全),保障高可用。
2.负责基于Docker/Kubernetes的容器化平台与CI/CD流水线的建设、维护与优化。
3.负责MySQL、Redis、Kafka、Nginx等中间件与数据库的日常运维、性能优化与容灾备份。
4.建立并维护7x24小时监控告警体系,快速响应与处理线上故障,参与应急保障。
工作职责:
1、保证线上业务系统稳定运行,服务故障分析与性能调优;
2、进行应急故障和事件处理,确保服务可用性;
3、设计开发运维自动化工具,提升运维效率和系统稳定性;
4、解决运维相关的技术问题,制定运维风险清单和应急预案;
任职要求:
1、统招本科以上计算机相关专业,3年以上运维经验;
2、熟练掌握k8s 、docker相关技术;
3、熟练掌握elk、hdfs数据存储相关技术;
4、熟练掌握nginx、openresty、lvs等负载均衡技术;
5、熟练掌握zabbix、openfalcon、ansible等监控及自动化配置工具;
6、熟练掌握java项目的运维部署,熟悉maven、nexus、git等工具的使用和维护;
7、熟练掌握mysql, mongodb, redis、kafka、zookeeper等主流数据库及中间的高用性架构部署、性能调优及日常运维;
8、熟练掌握Shell/Python/go等至少一门编程语言。
工作职责:
1、保证线上业务系统稳定运行,服务故障分析与性能调优;
2、进行应急故障和事件处理,确保服务可用性;
3、设计开发运维自动化工具,提升运维效率和系统稳定性;
4、解决运维相关的技术问题,制定运维风险清单和应急预案;
任职要求:
1、统招本科以上计算机相关专业,3年以上运维经验;
2、熟练掌握k8s 、docker相关技术;
3、熟练掌握elk、hdfs数据存储相关技术;
4、熟练掌握nginx、openresty、lvs等负载均衡技术;
5、熟练掌握zabbix、openfalcon、ansible等监控及自动化配置工具;
6、熟练掌握java项目的运维部署,熟悉maven、nexus、git等工具的使用和维护;
7、熟练掌握mysql, mongodb, redis、kafka、zookeeper等主流数据库及中间的高用性架构部署、性能调优及日常运维;
8、熟练掌握Shell/Python/go等至少一门编程语言。
长驻客户单位,负责客户系统售后服务与支持,包括软件维护、软件应用培训与推广、相关产品安装和局域网维护等工作。任职要求:
1、计算机或相关专业;具备软件维护和技术支持能力,熟悉大型数据库系统,有一般主机和网络管理维护能力;
2、性格开朗,具备良好的客户意识、沟通协调能力和良好的人际关系能力;
3、具有良好的自我调节能力和心理承受能力。
1.负责公司CI/CD系统维护工作并持续改进;
2.负责CI/CD开源工具的研究和应用;
3.通过开源工具整合CI/CD产品线,提升研发效率。
1)负责公司自有数据中心运维管理
2)负责机房服务器、存储、网络、自研设备的安装、调试、维护、故障处理
3)IT基础资源(软、硬件)的选型和优化,并负责资源运行状况的监控和分析
4)及时按要求撰写工作及技术文档;
5)领导安排的其它工作
运维工程师(J12231)8000-10000元/月
1.负责数据中心网络设备、安全设备、服务器、存储、云平台等基础设施的日常运维管理。
2.负责数据中心监控平台维护、升级、优化以及自定义监控开发工作。
3.负责数据中心网络安全防护工作,包括安全策略配置优化、安全日志分析、安全告警处理等。
4.负责数据中心网络、云主机和存储等资源规划和分配。
5.负责数据中心系统、网络故障排查和处理。
6.负责运维开发相关工具部署和维护,包括不限于:Nexus、GitLab、Harbor、Jira、Confluence、Dify等工具。
7.负责运维项目的全流程实施工作,包括项目项目技术方案编写、投标、实施交付等。
8.完成领导交办其他技术支持及安排其他工作。
1.英语六级及以上,读写流利、可进行常规口语沟通,能看懂 / 编写基础英文技术文档;
2.具备良好文字功底,擅长文档整理、流程总结,逻辑清晰;
3.计算机 / 网信相关专业优先,懂电脑系统、办公软件安装,基础网络故障排查;
4.了解主流 AI 工具、办公协作软件者优先;
5.做事认真负责、有主动服务意识,服从安排,能接受基础岗位培训,有一定抗压能力。
1.负责智驾平台计算服务日常运维工作,包括健康巡检、发布变更、监控完善、SOP、OnCall响应、故障处理等
2.负责智驾平台计算服务生产保障工作,包括需求处理、集群建设、资源交付、资源管理、测试验证等
3.参与智驾平台计算服务整体建设工作,包括K8S混合云服务、计算应用、多种类GPU/CPU等资源服务的自动化能力建设、成本管控和稳定性保障等
任职要求
1.搭建公司配置管理体系,定Git分支、基线规范,保障配置可追溯;
2.运维蓝鲸 / GitLab/Jenkins等DevOps平台,高效处理故障,管理团队资源权限;
3.用 Python/Shell 写脚本实现研发自动化,优化 “开发-发布”流程;
4.对接供应商推进平台升级,提供团队培训与技术支持。


