资阳项目运维
项目运维是指对项目的日常运营和维护工作,包括监控、故障排除、性能优化、安全管理等方面。项目运维人员通常负责确保项目系统的稳定性和可靠性,及时处理和解决系统故障和问题,保证项目的持续运行。项目运维还涉及到资源的规划和管理,监控系统运行情况,执行备份和恢复策略,进行容量规划和性能调优,持续改进和优化运维流程和工具。此外,项目运维人员可能还需要与开发团队合作,协助部署新的软件版本和功能,确保系统的稳定性和兼容性。综合来说,项目运维是确保项目系统平稳运行的重要职责,需要具备良好的技术能力、沟通协调能力和问题解决能力。
薪酬概览
平均月薪
¥7400
中位数 ¥0 | 区间 ¥5500 - ¥9300
数据来源:谈职全网10份招聘数据;更新时间:2026年7月13日
月薪分布
60% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
11月新增岗位
12
对比上月:岗位新增4
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 8 | 66.7% |
| 不限经验 | 4 | 33.3% |
热招职位
初中化学教师(青年教师)9-12W/年
到岗时间: 2026-08-20
1.对教材、教法和班级管理有准确、独到的理解,专业水平高,专业能力强。
2.善于学习和研究,教育教学业绩突出.
3.有学科能力之外的其他特长更佳。
4.有高端民办学校或者省级示范校以上工作经验更佳.
电修工3K以上/月
(1) 负责管辖范围内的各种电气维修工作,保证电气维修高质量地完成;
(2) 同承包商联系,反映机电设备质量和服务方面存在的问题,确保电气设备维修质量
(3) 及时进行日常维修及抢修工作,确保生产任务的顺利进行;
(4) 按时、保质保量完成PM计划,确保设备的正常运行;
(5) 经常观察设备运行情况,出现故障及时维修,保证设备运行的高效率;
(6) 执行管辖区域设备计划性巡检与预测性跟踪,并基于检查跟踪结果如实、清晰、完整地录入SAP系统;应对现象、数据等进行有逻辑性的分析,并提供建议或解决方案;
(7) 定期巡视管辖范围内的电气设备,负责电气相关的预防性维修、现场卫生管理和定置管理等,并及时发现和解决现场的自动化系统相关问题;
(8) 根据维修计划员的PM、修复件及停产维修计划,按标准操作流程和维修规范及时完成维修任务,并如实记录工作结果。
(9) 根据操作人员的应急维修通知,及时分析故障原因,提出建议及解决方案, 并及时实施应急性维修, 迅速排除设备故障,保证生产顺利进行,并如实记录工作结果;
(10) 严格按照EHS政策实施各项维修任务,积极参与EHS活动,解决存在的EHS问题;
(11) 及时完成上级临时布置的工作与任务。
1.搭建公司配置管理体系,定Git分支、基线规范,保障配置可追溯;
2.运维蓝鲸 / GitLab/Jenkins等DevOps平台,高效处理故障,管理团队资源权限;
3.用 Python/Shell 写脚本实现研发自动化,优化 “开发-发布”流程;
4.对接供应商推进平台升级,提供团队培训与技术支持。
岗位核心价值
负责公司大算力 AI 集群(含 B/H 系列高端卡、国产算力卡)的架构设计、搭建部署、运维优化与国产化适配,支撑大模型训练、自动驾驶等核心业务的高效稳定运行,打造高可用、高性价比的算力基础设施。
核心工作职责
1. 大算力集群自建与架构设计:主导超大规模 AI 算力集群(数千 P 级)的自建规划,包括硬件选型(GPU/B/H 系列卡、国产卡等)、网络拓扑设计(InfiniBand/ROCE)、存储架构(分布式存储)、集群调度系统搭建,确保集群性能达标、扩展性强。
2. 高端 GPU 加速与优化:具备 NVIDIA B 系列、H 系列高端算力卡的实战经验,负责卡级性能调优、并行计算加速(TensorRT/MPI/NCCL)、显存优化,解决大模型训练 / 推理中的算力瓶颈问题。
3. 国产算力卡适配落地:主导国产算力卡(阿里PPU、华为昇腾等)的适配工作,包括驱动安装、框架适配(TensorFlow/PyTorch/MindSpore)、模型迁移与性能调优,实现国产算力与业务场景的深度融合。
4. 集群运维与稳定性保障:负责算力集群的日常运维,包括硬件故障排查、集群监控告警(GPU / 网络 / 存储状态)、资源调度优化、灾备方案设计,保障集群全年高可用性(99.9% 以上)。
5. 技术沉淀与迭代:跟进业界大算力集群技术趋势(如新型 GPU、网络协议、调度系统),输出技术方案与最佳实践;搭建集群运维自动化工具,提升运维效率。
1、对部署效率负责,对相关工具的建设负责,实现多产品组合一键部署,无人值守安装,落地基于不可变基础设施的部署方案;
2、负责运维体系建设,包括可观测性体系,北极星指标体系,CMDB,工单系统,作业平台等;
3、参与制定SRE相关的规范和流程,并负责推广落地;
4、负责SRE团队技能建设,团队技术分享、团队技术选型、团队技术培训等;
5、作为团队技术专家,负责解决重大疑难问题,团队知识库建设,故障复盘,常见问题沉淀,预案体系建设,混沌工程建设。
1. 协助运维人员进行服务器、网络设备、存储设备等设备的日常运维工作,并及时处理出现的问题;
2. 协助运维人员编写文档,记录相应的操作流程、日常工作和服务器的维护情况等;
3. 参与服务器应用的安装、维护和升级工作,通过对生产环境进行技术测试和排查异常,为公司IT系统的稳定运行做好技术支持;
4. 参与公司IT系统的监控、数据备份等工作,及时处理并防止系统出现故障。
工作内容:
1、负责日常资源交付、变更、巡检、告警处置与故障恢复工作,沉淀输出标准化操作流程;
2、参与可观测体系、容量管理、混沌工程、流量调度等方向的平台与体系持续优化演进;
3、主导基于大语言模型(LLM)的运维智能体(AI Agent)、AI工作流方案设计,落地运维数字人、AI巡检、AI根因分析等AIOps业务场景。
任职资格:
1、本科及以上学历,拥有3年及以上AI开发或运维相关工作经验;
2、熟练掌握Python/Go至少一门编程语言者优先;
3、熟悉Linux操作系统,了解Kubernetes(K8s)基础概念;熟练使用Prometheus、DNS、CDN、CICD、Nginx等常用中间件与服务,具备传统运维故障排查、自动化脚本编写实操能力;
4、了解可观测、容量管理、高可用容灾架构、混沌工程、流量调度相关知识,拥有大规模集群稳定性保障实战经验优先;
5、熟悉LangChain、LangGraph、Dify等主流Agent开发框架,掌握MCP、技能插件(Skills)、Prompt&RAP、多智能体规划相关技术;
6、具备优秀的问题拆解、逻辑分析、跨团队沟通协作能力,学习主动性强、自驱力突出。
工作内容:
1、负责日常资源交付、变更、巡检、告警处置与故障恢复工作,沉淀输出标准化操作流程;
2、参与可观测体系、容量管理、混沌工程、流量调度等方向的平台与体系持续优化演进;
3、主导基于大语言模型(LLM)的运维智能体(AI Agent)、AI工作流方案设计,落地运维数字人、AI巡检、AI根因分析等AIOps业务场景。
任职资格:
1、本科及以上学历,拥有3年及以上AI开发或运维相关工作经验;
2、熟练掌握Python/Go至少一门编程语言者优先;
3、熟悉Linux操作系统,了解Kubernetes(K8s)基础概念;熟练使用Prometheus、DNS、CDN、CICD、Nginx等常用中间件与服务,具备传统运维故障排查、自动化脚本编写实操能力;
4、了解可观测、容量管理、高可用容灾架构、混沌工程、流量调度相关知识,拥有大规模集群稳定性保障实战经验优先;
5、熟悉LangChain、LangGraph、Dify等主流Agent开发框架,掌握MCP、技能插件(Skills)、Prompt&RAP、多智能体规划相关技术;
6、具备优秀的问题拆解、逻辑分析、跨团队沟通协作能力,学习主动性强、自驱力突出。
岗位描述:
1. 负责企业IT基础设施(服务器/网络/存储/动环系统)的日常监控、维护及性能优化,保障业务系统稳定运行。
2. 负责虚拟化,公有/私有云平台的平台部署与日常运维管理,保障业务稳定性。
3. 实施运维自动化方案,使用Ansible等工具实现配置管理、批量部署等自动化运维场景。
4. 负责设备安全加固,包括系统漏洞修复、安全基线配置、入侵检测等安全运维工作。
5. 管理中间件集群(如Redis/Nginx/Kafka等),设计高可用架构并优化性能。
6. 完善监控告警体系,通过Zabbix/Prometheus等工具实现故障预警与快速定位。
7. 参与运维标准化建设,编写技术文档并推动最佳实践落地。
1、负责阿里巴巴数据中心IT运营管理工作,负责服务器/网络运维和IT交付管理,参与数据中心的建设与扩容,确保业务稳定运行,在运维质量、效率、成本与安全之间取得平衡。
2、制定、记录并监督执行符合行业最佳实践及满足SLA要求的各项政策与流程。
3、协调外部供应商,确保资源供应与交付及时到位,匹配业务增长需求。
4、负责托管数据中心服务提供商的外包与供应商管理,确保其服务表现达到或超过合同约定的SLA标准。
5、熟悉7×24小时现场支持流程,持续优化运营流程、方法与工具。
6、负责优化数据中心IT运维工作,制定运维管理体系、标准操作规程(SOP)和应急操作规程(EOP)。
7、负责业务设备的现场技术支持,理解业务需求与网络架构,通过团队协作高效支撑数据中心运营。
诚云科技-资深运维工程师-云平台运维与交付(央部及北方大区)
• 客户现场专项技术负责人
• 如网络专项、数据库专项
• 平台稳定性重大变更方案制定与实施
• 如性能/存储优化、底座改造等
• 现场故障应急执行
• 协助原厂尽快恢复平台运行
• 关键时刻现场保障
• 如客户平台隐患深度排查与治理,复杂问题原因定位及解决
冷运项目运维专员面议
1、负责跟进公司项目客户订单端到端全生命周期的落地,如有异常及时介入干预;
2、定期与项目客户的相关人员进行沟通,掌握客户对我司服务的反馈;
3、拉通内部各部门对客户反馈的问题进行改善,并跟进改善效果;
4、对客户提出的新需求,拉通内部各部门给出解决方案,沟通客户确保方案的可落地性;
5、对客户的需求、异常工作形成台账,定期进行内部的汇报;
1、系统化学习与融入:
深入学习并掌握公司及部门的各项规章制度、安全规范、操作流程和企业文化;
全面熟悉蜀园社区的整体环境、设施设备布局、各功能区域及核心运行保障系统(强电、弱电、暖通、给排水、消防、楼宇自控等);
系统学习养老社区设施设备运维管理的专业知识、技术标准和最佳实践。
2、多模块轮岗实践:
根据培养计划,在运行保障部核心运维模块(包括但不限于强电系统、弱电系统、暖通空调系统、消防系统、中控室/BAS系统等)进行深度轮岗学习与实践;
重点学习掌握各模块设施设备的基础原理、操作规程、日常巡检、基础维护保养、常见问题识别与初步处理方法;
协助各模块工程师完成日常运维工作,积累实践经验(注:轮岗以学习实践为主,不涉及独立值班或强制夜班要求)。
3、项目实践与能力提升:
在资深工程师或项目经理的指导下,参与设施设备的性能优化、能效提升、预防性维护计划完善、运维流程梳理与改进等工作;
协助分析设备运行数据,识别损耗点,提出并参与实施降低运行成本、提高可靠性的方案;
学习项目管理的初步知识,参与项目计划的制定、执行、跟踪与总结。
4、综合能力发展与汇报:
定期总结轮岗及项目实践的学习成果、心得体会及遇到的问题,向上级领导汇报;
积极参与部门内外的技术交流与培训,持续提升专业技能和综合素质。




