甘孜藏族自治州IT运维
IT运维(Information Technology Operations)是指负责管理、维护和支持组织的IT基础设施和系统的活动。IT运维人员负责确保网络、服务器、数据库和应用程序的稳定运行,及时解决技术问题和故障。他们监控系统性能、备份数据、更新软件、处理安全漏洞等任务,以确保系统安全和稳定。此外,IT运维人员还负责设备部署、配置和维护,以满足组织的业务需求。他们通常需要具备良好的技术和沟通能力,能够快速响应和解决技术问题,确保组织IT系统的高效运行。IT运维在现代企业中扮演着重要的角色,对于业务的持续性和成功运营至关重要。
薪酬概览
平均月薪
¥7100
中位数 ¥6000 | 区间 ¥5600 - ¥8600
数据来源:样本数量过少,仅供参考;更新时间:2026年7月13日
月薪分布
60% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
2月新增岗位
44
对比上月:岗位新增32
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 14 | 32.6% |
| 3-5年 | 29 | 67.4% |
热招职位
电气监理工程师(甘孜州光伏项目)5-8K/月
1、参与编制监理规划,负责编制本专业的监理实施细则。2 、审查施工单位提交的涉及本专业的报审文件,并向总监理工程师报告。3 、参与审核分包单位资格。4 、指导、检查监理员工作,定期向总监理工程师报告本专业监理工作实施情况。
5、检查进场的工程材料、构配件、设备的质量。
6、组织验收检验批、隐蔽工程及分项工程,参与验收分部工程、单位工程。
7、处置发现的质量问题和安全生产事故隐患,并报告总监理工程师。8 、提出本专业危险性较大的分部分项工程监理措施,并开展监理检查。
9、进行工程计量。
10、参与工程变更的审查和处理。
11、组织编写监理日志,参与编写监理月报。
12、参与收集、整理监理文件。
13、参与工程竣工预验收和竣工验收。
任职资格:
1、大专及以上学历,工程相关专业,中级及以上职称;
2、2年以上电力施工或监理工作经验,能独立处理施工现场问题;
3、较强的沟通协调能力;
4、熟悉电脑操作;
5、身体健康;
6、能适应高海拔地区监理工作,项目平均海拔约3800-4000米。
1.负责智驾平台计算服务日常运维工作,包括健康巡检、发布变更、监控完善、SOP、OnCall响应、故障处理等
2.负责智驾平台计算服务生产保障工作,包括需求处理、集群建设、资源交付、资源管理、测试验证等
3.参与智驾平台计算服务整体建设工作,包括K8S混合云服务、计算应用、多种类GPU/CPU等资源服务的自动化能力建设、成本管控和稳定性保障等
任职要求
1.搭建公司配置管理体系,定Git分支、基线规范,保障配置可追溯;
2.运维蓝鲸 / GitLab/Jenkins等DevOps平台,高效处理故障,管理团队资源权限;
3.用 Python/Shell 写脚本实现研发自动化,优化 “开发-发布”流程;
4.对接供应商推进平台升级,提供团队培训与技术支持。
岗位核心价值
负责公司大算力 AI 集群(含 B/H 系列高端卡、国产算力卡)的架构设计、搭建部署、运维优化与国产化适配,支撑大模型训练、自动驾驶等核心业务的高效稳定运行,打造高可用、高性价比的算力基础设施。
核心工作职责
1. 大算力集群自建与架构设计:主导超大规模 AI 算力集群(数千 P 级)的自建规划,包括硬件选型(GPU/B/H 系列卡、国产卡等)、网络拓扑设计(InfiniBand/ROCE)、存储架构(分布式存储)、集群调度系统搭建,确保集群性能达标、扩展性强。
2. 高端 GPU 加速与优化:具备 NVIDIA B 系列、H 系列高端算力卡的实战经验,负责卡级性能调优、并行计算加速(TensorRT/MPI/NCCL)、显存优化,解决大模型训练 / 推理中的算力瓶颈问题。
3. 国产算力卡适配落地:主导国产算力卡(阿里PPU、华为昇腾等)的适配工作,包括驱动安装、框架适配(TensorFlow/PyTorch/MindSpore)、模型迁移与性能调优,实现国产算力与业务场景的深度融合。
4. 集群运维与稳定性保障:负责算力集群的日常运维,包括硬件故障排查、集群监控告警(GPU / 网络 / 存储状态)、资源调度优化、灾备方案设计,保障集群全年高可用性(99.9% 以上)。
5. 技术沉淀与迭代:跟进业界大算力集群技术趋势(如新型 GPU、网络协议、调度系统),输出技术方案与最佳实践;搭建集群运维自动化工具,提升运维效率。
1、对部署效率负责,对相关工具的建设负责,实现多产品组合一键部署,无人值守安装,落地基于不可变基础设施的部署方案;
2、负责运维体系建设,包括可观测性体系,北极星指标体系,CMDB,工单系统,作业平台等;
3、参与制定SRE相关的规范和流程,并负责推广落地;
4、负责SRE团队技能建设,团队技术分享、团队技术选型、团队技术培训等;
5、作为团队技术专家,负责解决重大疑难问题,团队知识库建设,故障复盘,常见问题沉淀,预案体系建设,混沌工程建设。
1. 协助运维人员进行服务器、网络设备、存储设备等设备的日常运维工作,并及时处理出现的问题;
2. 协助运维人员编写文档,记录相应的操作流程、日常工作和服务器的维护情况等;
3. 参与服务器应用的安装、维护和升级工作,通过对生产环境进行技术测试和排查异常,为公司IT系统的稳定运行做好技术支持;
4. 参与公司IT系统的监控、数据备份等工作,及时处理并防止系统出现故障。
运维开发工程师(服务器运维平台背景优先)薪资:20000~35000
1. 负责成本运营平台、服务器工单交付平台、配件管理平台、故障工单平台等服务器运维管理系统的前后端开发与功能实现2. 负责现有运维平台的性能优化、功能迭代及线上部署工作,保障系统稳定高效运行3. 负责服务器运维操作的 API 封装与标准化开发,构建统一的运维自动化接口体系4. 参与服务器硬件管理相关核心功能设计与开发,包括 BMC/BIOS 远程管理、硬件状态实时监控、驱动固件批量升级、硬件故障智能诊断等模块5. 结合服务器硬件测试与验证经验,优化运维平台的硬件兼容性检测、性能指标采集和故障预警能力,可以开发自动化测试脚本6. 参与硬件搭载软件相关的应用测试模型设计,提升平台对不同硬件配置的适配性
1.负责公司版本部署工作
2.负责 Linux 服务器、网络设备及云服务(AWS/阿里云/腾讯云等)的日常监控、维护与故障排查,保障系统稳定性。
3.负责 Docker 容器环境的构建、管理及 Kubernetes (K8s) 集群的部署、运维和性能调优。
4.维护和完善持续集成/持续部署流水线,支持研发团队的快速迭代交付。
5.搭建和优化监控系统,确保关键业务指标可观测,并及时响应告警。
1、负责公司办公环境的软硬件和桌面系统的日常维护,解决排除各种软硬件故障;
2、负责公司内部各部门常用办公软件的安装以及故障排除;
3、负责桌面计算机、显示器、电话、打印机、网络设施、视频会议终端安装、配置、升级、运行维护与管理,计算机终端各类操作系统的安装与维护保障桌面系统正常运行,满足日常工作的需要。
4、配合资产执行,申请、领用、更换、报废、敏感数据清理,设备标准化等操作;
5、负责配合网络工程师完成新环境网络搭建,公司办公内网络环境维护,配合完成信息系统安装升级卸载等工作相关系统运维;
6、完成上级领导交办的其他工作。
1. 负责内部运维基础设施(如 自动化运维、IaC、CMDB、服务树、应用中心、DNS、流量网关、VPN 接入)等推进和落地。
2. 负责 devops 平台的建设、负责 AI 时代下 AIOps 研发流程的建设。
3. 负责微服务体系能力建设,如多集群场景下 服务发现、微服务网关、服务治理、迭代及流量泳道等体系建设。
一. 网络运维与稳定性保障
1.负责公司内部网络日常运维管理,保障网络架构的高可用性与稳定性;
2.参与企业级网络架构设计与实施及技术方案落地;
3.快速响应并处理网络故障,主导故障排查、根因分析及应急处置,提升系统恢复效率;
4.跟踪主流网络技术发展趋势,持续提升技术能力。
二. 网络项目实施与交付
1.制定并输出标准化的技术实施文档、网络规范及运维手册,规范项目流程;
2.协助团队技术能力提升,通过项目实战进行技术分享与经验沉淀;
3.编写技术文档、操作手册及应急预案,参与网络设备过保替换、无线网络优化等网络项目的实施与交付。
三. 运维监控及自动化
1.负责公司内部网络基础设施的日常监控、维护与优化,保障网络高可用性与稳定性,整合监控、告警、指标采集及自动化运维工具能力;
2.建立统一的网络可观测性指标体系,实现对网络运行状态的实时监控、数据化管理及可视化展示;
3.推动网络运维自动化与智能化,参与编写脚本或使用运维工具提升运维效率。
1. 本科及以上学历,电子工程、车辆工程等相关专业;
2. 5年+ BMS/汽车电子开发经验,完整参与1个以上新能源汽车量产项目;
3. 精通V模型开发流程、BMS需求管理(S1/S2)与变更控制;
4. 具备系统工程思维、软件集成基础与问题排查能力;
5. 熟练使用BMS开发相关工具链,具备模型开发、测试、标定与数据分析能力;
6. 兼具BMS软硬件开发经验者或有主流车企/Tier-1供应商DRE/PD岗位背景者优先。




