阿坝藏族羌族自治州Service Engineer
Service Engineer是指负责在客户的现场安装、调试、维护和维修公司的产品或设备的工程师。他们需要对公司的产品或设备非常熟悉,能够及时解决客户遇到的问题,并确保产品或设备能够正常运行。此外,Service Engineer还需要与客户保持良好的沟通,及时了解客户的需求和反馈,为客户提供专业的技术支持和维护服务。这个岗位需要具备良好的技术能力、沟通能力和问题解决能力。
薪酬概览
平均月薪
¥5800
中位数 ¥5500 | 区间 ¥4700 - ¥7000
数据来源:样本数量过少,仅供参考;更新时间:2026年7月13日
月薪分布
83.3% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
2月新增岗位
24
对比上月:岗位新增20
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 19 | 82.6% |
| 3-5年 | 4 | 17.4% |
热招职位
1.贯彻执行安迪苏中国在单胃市场云贵川渝地区的业务战略
2.根据区业务预算,确保业务目标的达成。
3.管理区域客户的回款工作
4.协调其他部门及时地处理客户投诉;
5.完善年度业务计划,包括但不限于新产品的推广和现有产品的销售活动;
6.提交月度销售报告,项目的更新和预测;
7.收集客户和竞争对手情报,并分享给市场团队
8.根据公司业务战略优化客户结构;
9.给其他职能部门提供必要的协调,包括但不限于设备方面、财务方面给以及供应量方面相关工作。
10.与大客户团队紧密合作,管理区域层面的大客户业务
11.其它由上级主管安排的相关工作事项。
12.确保本人工作活动符合公司劳动纪律/HSE规范要求。
岗位描述
我们正在招聘智能运维开发工程师,负责阿里云大数据平台的智能运维体系建设,面向超大规模大数据平台、AI 平台及相关基础设施,持续提升系统稳定性、运维效率和平台自动化能力。
该岗位将深度参与大数据平台运维平台开发、稳定性治理、AI 化改造和智能运维 Agent 建设,围绕故障发现、问题诊断、容量水位、变更风险、发布管控、监控告警、自动化处置等核心场景,建设面向超大规模复杂系统的智能化运维能力。
你将与研发、SRE、平台工程、算法和产品团队协作,推动传统运维能力向平台化、自动化、智能化演进,支撑阿里云大数据平台及 AI 平台在大规模、高复杂度、高可用要求下稳定运行。
工作职责
1. 负责阿里云大数据平台智能运维体系建设,参与运维平台、稳定性平台、自动化工具、诊断系统等核心能力的设计与开发,提升平台化、自动化和智能化运维水平。
2. 参与智能运维 Agent 建设,结合大模型、RAG、工具调用、自动化编排和知识库能力,落地日志分析、指标分析、故障归因、异常检测、根因定位、SOP 执行和运维问答等 AI 化运维能力。
3. 负责超大规模大数据平台及 AI 平台的稳定性保障,围绕监控告警、故障诊断、容量水位、链路治理、变更风险、应急处置和复盘改进等场景,持续提升系统可靠性。
4. 参与大数据平台架构演进和稳定性治理,识别系统瓶颈与稳定性风险,推动容量规划、性能优化、资源治理、容灾高可用和架构改进。
阿里云智能-运维开发-AIOps Agent工程师(售后技术方向)
我们正在招聘运维开发工程师,负责阿里云大数据&AI平台的售后智能答疑体系和客户体感稳定性体系建设,从用户服务专家的视角来处理超大规模大数据平台承载的用户问题和重保需求,持续提升运维效率,为产品稳定性和服务口碑树立持续贡献力量
该岗位以大数据&AI产品售后答疑工作为业务基础,一方面深度参与共建Agent架构下的智能答疑能力,围绕问题自助答疑、自助诊断和产品改进项提炼等核心场景进行自动化能力建设;另一方面深度参与客户体感稳定性体系和重保能力建设,在对产品架构和稳定性场景深入掌握的基础上,提炼客户实例级稳定性指标,为客户提供更前置的主动隐患发现与重保服务能力
你将与TAM、研发、SRE、平台工程、算法和产品团队协作,推动传统答疑和排查能力向智能化演进,支撑阿里云大数据&AI平台业务高速发展,共建业界一流的智能服务专家团队
工作职责:
1. 负责阿里云大数据&AI产品的售后L3答疑和服务工作,承接前方服务团队的升级工单处理和用户疑难问题排查;组织和提供大客户钉群服务能力,对头部/重要客户进行业务保障;接收客户需求提供业务巡检、大促护航、产品改进推动等重保能力交付
2. 参与基于Agent的智能答疑体系建设,结合大模型、RAG、Skills、Harness engineer等技术能力,落地根因定位、异常检测、SOP执行和运维问答等AI化运维能力
3. 参与客户体感稳定性系统建设,协同产研SRE建立实例级可用率指标,定义客户级体感可用率标准,构建细粒度封网、变更后置、主动巡检和风险发现预防等重保能力,推动客户问题发现与主动服务链路落地,为产品提供更强的增值能力
4. 负责售后支持外包团队的管理,包括答疑提效、人员培养和成本管理等职责
1. 中间件运维与高可用保障:负责消息队列(Kafka/RocketMQ)、服务注册与配置中心(Zookeeper/Nacos)等核心中间件的稳定性维护、性能调优及高可用架构设计;基于Kubernetes完成容器化部署、弹性扩缩容、版本升级及日常运维,保障核心系统7x24小时稳定运行。
2. 故障排查与根因分析:通过日志分析、链路追踪及监控体系快速定位中间件相关故障(如消息堆积、服务注册异常等),主导问题修复与复盘;使用Java或Go开发调试工具,高效排查线上性能瓶颈及与业务系统的兼容性问题。
3. 性能优化与平台适配:测试并优化中间件在不同CPU架构、内核版本及容器环境下的性能表现,解决资源调度与性能瓶颈问题,持续提升中间件运行效率与资源利用率。
4. 负责搭建及使用SRE数字人实现线上运维智能化。
运维工程师面议
1.负责CentOS/国产麒麟系统的服务器与云资源的全生命周期管理(部署、监控、调优、安全),保障高可用。
2.负责基于Docker/Kubernetes的容器化平台与CI/CD流水线的建设、维护与优化。
3.负责MySQL、Redis、Kafka、Nginx等中间件与数据库的日常运维、性能优化与容灾备份。
4.建立并维护7x24小时监控告警体系,快速响应与处理线上故障,参与应急保障。
工作职责:
1、保证线上业务系统稳定运行,服务故障分析与性能调优;
2、进行应急故障和事件处理,确保服务可用性;
3、设计开发运维自动化工具,提升运维效率和系统稳定性;
4、解决运维相关的技术问题,制定运维风险清单和应急预案;
任职要求:
1、统招本科以上计算机相关专业,3年以上运维经验;
2、熟练掌握k8s 、docker相关技术;
3、熟练掌握elk、hdfs数据存储相关技术;
4、熟练掌握nginx、openresty、lvs等负载均衡技术;
5、熟练掌握zabbix、openfalcon、ansible等监控及自动化配置工具;
6、熟练掌握java项目的运维部署,熟悉maven、nexus、git等工具的使用和维护;
7、熟练掌握mysql, mongodb, redis、kafka、zookeeper等主流数据库及中间的高用性架构部署、性能调优及日常运维;
8、熟练掌握Shell/Python/go等至少一门编程语言。
工作职责:
1、保证线上业务系统稳定运行,服务故障分析与性能调优;
2、进行应急故障和事件处理,确保服务可用性;
3、设计开发运维自动化工具,提升运维效率和系统稳定性;
4、解决运维相关的技术问题,制定运维风险清单和应急预案;
任职要求:
1、统招本科以上计算机相关专业,3年以上运维经验;
2、熟练掌握k8s 、docker相关技术;
3、熟练掌握elk、hdfs数据存储相关技术;
4、熟练掌握nginx、openresty、lvs等负载均衡技术;
5、熟练掌握zabbix、openfalcon、ansible等监控及自动化配置工具;
6、熟练掌握java项目的运维部署,熟悉maven、nexus、git等工具的使用和维护;
7、熟练掌握mysql, mongodb, redis、kafka、zookeeper等主流数据库及中间的高用性架构部署、性能调优及日常运维;
8、熟练掌握Shell/Python/go等至少一门编程语言。
1.负责智驾平台计算服务日常运维工作,包括健康巡检、发布变更、监控完善、SOP、OnCall响应、故障处理等
2.负责智驾平台计算服务生产保障工作,包括需求处理、集群建设、资源交付、资源管理、测试验证等
3.参与智驾平台计算服务整体建设工作,包括K8S混合云服务、计算应用、多种类GPU/CPU等资源服务的自动化能力建设、成本管控和稳定性保障等
任职要求
1.搭建公司配置管理体系,定Git分支、基线规范,保障配置可追溯;
2.运维蓝鲸 / GitLab/Jenkins等DevOps平台,高效处理故障,管理团队资源权限;
3.用 Python/Shell 写脚本实现研发自动化,优化 “开发-发布”流程;
4.对接供应商推进平台升级,提供团队培训与技术支持。
岗位核心价值
负责公司大算力 AI 集群(含 B/H 系列高端卡、国产算力卡)的架构设计、搭建部署、运维优化与国产化适配,支撑大模型训练、自动驾驶等核心业务的高效稳定运行,打造高可用、高性价比的算力基础设施。
核心工作职责
1. 大算力集群自建与架构设计:主导超大规模 AI 算力集群(数千 P 级)的自建规划,包括硬件选型(GPU/B/H 系列卡、国产卡等)、网络拓扑设计(InfiniBand/ROCE)、存储架构(分布式存储)、集群调度系统搭建,确保集群性能达标、扩展性强。
2. 高端 GPU 加速与优化:具备 NVIDIA B 系列、H 系列高端算力卡的实战经验,负责卡级性能调优、并行计算加速(TensorRT/MPI/NCCL)、显存优化,解决大模型训练 / 推理中的算力瓶颈问题。
3. 国产算力卡适配落地:主导国产算力卡(阿里PPU、华为昇腾等)的适配工作,包括驱动安装、框架适配(TensorFlow/PyTorch/MindSpore)、模型迁移与性能调优,实现国产算力与业务场景的深度融合。
4. 集群运维与稳定性保障:负责算力集群的日常运维,包括硬件故障排查、集群监控告警(GPU / 网络 / 存储状态)、资源调度优化、灾备方案设计,保障集群全年高可用性(99.9% 以上)。
5. 技术沉淀与迭代:跟进业界大算力集群技术趋势(如新型 GPU、网络协议、调度系统),输出技术方案与最佳实践;搭建集群运维自动化工具,提升运维效率。
1、对部署效率负责,对相关工具的建设负责,实现多产品组合一键部署,无人值守安装,落地基于不可变基础设施的部署方案;
2、负责运维体系建设,包括可观测性体系,北极星指标体系,CMDB,工单系统,作业平台等;
3、参与制定SRE相关的规范和流程,并负责推广落地;
4、负责SRE团队技能建设,团队技术分享、团队技术选型、团队技术培训等;
5、作为团队技术专家,负责解决重大疑难问题,团队知识库建设,故障复盘,常见问题沉淀,预案体系建设,混沌工程建设。
1. 协助运维人员进行服务器、网络设备、存储设备等设备的日常运维工作,并及时处理出现的问题;
2. 协助运维人员编写文档,记录相应的操作流程、日常工作和服务器的维护情况等;
3. 参与服务器应用的安装、维护和升级工作,通过对生产环境进行技术测试和排查异常,为公司IT系统的稳定运行做好技术支持;
4. 参与公司IT系统的监控、数据备份等工作,及时处理并防止系统出现故障。
1.英语六级及以上,读写流利、可进行常规口语沟通,能看懂 / 编写基础英文技术文档;
2.具备良好文字功底,擅长文档整理、流程总结,逻辑清晰;
3.计算机 / 网信相关专业优先,懂电脑系统、办公软件安装,基础网络故障排查;
4.了解主流 AI 工具、办公协作软件者优先;
5.做事认真负责、有主动服务意识,服从安排,能接受基础岗位培训,有一定抗压能力。




