资阳项目运维工程师
项目运维工程师是负责项目的运营和维护的专业人员。他们负责确保项目的稳定运行,包括监控系统状态、处理日常的技术问题、及时修复系统故障、优化系统性能、升级软件版本等。他们还负责制定和执行项目的运维策略,确保项目的安全性和可靠性。同时,他们与开发团队紧密合作,提供技术支持和解决方案,以满足项目的需求。项目运维工程师需要具备扎实的技术背景和问题解决能力,熟悉常见的运维工具和技术,对系统和网络有深入的理解,能够快速响应和解决各类技术问题,保证项目的持续稳定运行。
薪酬概览
平均月薪
¥7400
中位数 ¥0 | 区间 ¥5500 - ¥9300
数据来源:谈职全网10份招聘数据;更新时间:2026年7月13日
月薪分布
60% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
11月新增岗位
12
对比上月:岗位新增4
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 8 | 66.7% |
| 不限经验 | 4 | 33.3% |
热招职位
初中化学教师(青年教师)9-12W/年
到岗时间: 2026-08-20
1.对教材、教法和班级管理有准确、独到的理解,专业水平高,专业能力强。
2.善于学习和研究,教育教学业绩突出.
3.有学科能力之外的其他特长更佳。
4.有高端民办学校或者省级示范校以上工作经验更佳.
电修工3K以上/月
(1) 负责管辖范围内的各种电气维修工作,保证电气维修高质量地完成;
(2) 同承包商联系,反映机电设备质量和服务方面存在的问题,确保电气设备维修质量
(3) 及时进行日常维修及抢修工作,确保生产任务的顺利进行;
(4) 按时、保质保量完成PM计划,确保设备的正常运行;
(5) 经常观察设备运行情况,出现故障及时维修,保证设备运行的高效率;
(6) 执行管辖区域设备计划性巡检与预测性跟踪,并基于检查跟踪结果如实、清晰、完整地录入SAP系统;应对现象、数据等进行有逻辑性的分析,并提供建议或解决方案;
(7) 定期巡视管辖范围内的电气设备,负责电气相关的预防性维修、现场卫生管理和定置管理等,并及时发现和解决现场的自动化系统相关问题;
(8) 根据维修计划员的PM、修复件及停产维修计划,按标准操作流程和维修规范及时完成维修任务,并如实记录工作结果。
(9) 根据操作人员的应急维修通知,及时分析故障原因,提出建议及解决方案, 并及时实施应急性维修, 迅速排除设备故障,保证生产顺利进行,并如实记录工作结果;
(10) 严格按照EHS政策实施各项维修任务,积极参与EHS活动,解决存在的EHS问题;
(11) 及时完成上级临时布置的工作与任务。
1. 负责超大规模大数据平台及 AI平台的稳定性保障,围绕监控告警、故障诊断、容量水位、链路治理、变更风险、应急处置和复盘改进等场景,持续提升系统可靠性。
2. 负责生产环境部署、发布、扩缩容、迁移等关键场景的稳定性保障,沉淀交付与运营的标准化方案。
3. 负责支持客户业务平稳迁移方案设计、适配、风险评估,在迁移关键节点提供稳定性兜底。
4. 参与智能运维 Agent建设,结合大模型、RAG、工具调用、自动化编排和知识库能力,落地日志分
析、指标分析、故障归因、异常检测、根因定位、SOP 执行和运维问答等AI化运维能力。
负责政企专有云平台的安全体系建设与日常运营,统筹云内安全产品运维、云外安全设备管理及合规评测全流程,保障平台安全稳定运行。该岗位需驻场客户现场,作为平台安全的第一责任人,在高压环境下独立推进安全运营工作,并通过业务梳理与AI工具应用持续提升安全运营效率。
一、云平台安全产品运营
负责云平台内置安全产品的部署、配置、策略优化及日常运维,包括但不限于云盾(DDoS防护/主机安全)、Web应用防火墙(WAF)、安骑士(主机入侵检测与基线核查)、加密机(密钥管理与数据加密服务)等。定期审视安全策略有效性,结合业务变化动态调整防护规则,确保安全能力与业务需求匹配。对安全告警进行分级处置,建立从告警发现、研判分析到闭环处置的标准化流程,持续降低误报率并提升威胁响应时效。
二、云外安全设备管理
负责传统安全设备的运维与策略管理,包括下一代防火墙四至七层访问控制规则的规划、配置与审计,IPS/IDS入侵防御系统的特征库更新与自定义规则调优,API安全网关的检测策略配置与异常流量分析等。定期开展安全设备健康巡检与性能评估,推动老旧设备迭代替换方案落地。配合网络团队完成安全域划分、边界隔离及跨域访问管控,确保纵深防御体系完整有效。
三、大型系统与网络安全维护
承担平台整体安全架构的日常维护与应急响应,覆盖操作系统加固、中间件安全配置、数据库访问审计、容器运行时安全等多个层面。参与重大变更的安全评审,对高风险操作制定回退预案并全程监护。主导或参与安全事件的调查溯源,输出根因分析报告并推动整改措施落地。建立安全知识库与应急预案体系,定期组织攻防演练与安全培训,提升团队整体安全实战能力。
四、合规评测全流程支撑
作为平台侧合规对接人,统筹推进等级保护测评(三级及以上)、商用密码应用安全性评估(密评)、安全审计评测等合规认证工作。熟悉各类评测的标准要求、测评流程及材料准备规范,能够独立完成差距分析、整改方案制定、证据材料整理及现场测评配合。推动合规检查项的自动化采集与归档能力建设,将周期性合规验证从人工逐项核对升级为系统化、可持续的自动化合规运营。
五、AI驱动的安全运营提效
主动梳理安全运营中的重复性、高耗时业务场景(如告警研判、日志分析、合规材料生成、策略巡检等),沉淀为可结构化的业务知识。探索并落地AI工具在安全运营中的应用,例如利用大模型辅助告警分类与威胁情报关联分析、自动生成合规报告初稿、智能化策略推荐等,切实提升个人及团队的工作效能。持续关注AI安全领域的新技术与新方法,推动安全运营能力的持续进化。
1.设备检修维护管理1.1 负责检修策划书等计划内容、重要消缺工作的执行监督,严格按照检修策划书、测试方案进行检修工作,并签字确认;检修中发现的设备缺陷及时或不能立即处理的在EAM系统对应工单的完工报告对应项中进行登记,并如实记录入检修台账;
1.2 协同班长、副班长、专工,负责检修的过程验收及最终验收工作,汇总检修记录、缺陷记录,并按要求及时于EAM工单管理中上传检修清单、重点部位巡视表、检测报告等。
2.故障、缺陷管理2.1 对于A类缺陷,发现后立即向班长、副班长汇报,对于危及人身或设备安全的A类缺陷立即现场采取紧急处置;
2.2 对于B类缺陷负责在7日内主动向班长申请完成消缺,如不能及时消除则应列入下月消缺计划;
2.3 对C类缺陷负责依据具体情况安排进入月度消缺计划,一般不应超过2个月。
3. 技术监督管理3.1 负责班组年度技术监督计划的有序开展,并对外包的检测项目质量实施全过程监督;
3.2 负责检查检测报告的录入,保证检测报告均已上传EAM系统对应工单检修检测数据报告中;
3.3 参与检测报告总结会议,依据检测结果根据检测结果及现场实际情况,提出合理的、可行的解决(预防)方案;
3.4 负责检测异常整改计划的执行并参与整改效果的评价及验收。
4.技术改造及监督管理4.1 负责检修基地技术改造工作的实施及过程、质量监督;
4.2 负责协助专工开展技改验收和效果评价工作。
5.设备异动管理5.1 协助班长、副班长负责向集控运行提出设备异动申请单,并说明其必要性;
5.2 负责执行设备异动工作;
5.3 负责修改设备台账,做好班组设备异动统计。
6.设备停复役管理6.1 负责向集控运行提交符合要求的停运申请表;
6.2 设备提前复役的,需提前1小时电话告知集控运行;
6.3 设备复役后现场应告知集控运行设备运行注意要求,尤其是一些大部件修复、更换后。
7.风电场保护定值、控制逻辑管理7.1 负责在保护定值及控制逻辑变动前,执行OA“保护定值、控制逻辑变更”申请流程;
7.2 负责在保护定值或控制逻辑修改、异动、退出等工作执行时,遵守公司安全相关管理规定要求,并履行工作票手续。
8.设备分析管理8.1 对责任风机运行情况进行分析总结,参加检修基地月度设备分析会议,对异常机组提出可行的改进措施,并负责督促落实。
9.相关方管理9.1 关于所负责的项目,开工前对承包方的资质条件及“三措两案”等资料进行汇总初审后报EHS专工进行审核;
9.2 在OA上提交相关方开工手续的申请;
9.3 工作负责人在作业前对相关方工作面的危险点分析与预控措施的交待;
9.4 监督检查相关方“三措两案”落实情况,如有违反安全管理规定、安全技术措施不落实的情况,应现场给予指正,拒不整改者应向班长、副班长或 EHS 专工汇报,并对整改情况进行检查。
11.安全生产全过程监督管理11.1 人员隐患的自查与检查:操作人员自觉执行操作规程和应急处置技能情况;接受安全技能培训、安全教育、持证上岗、劳动保护情况;
11.2 设备隐患的检查:风机、箱变、集电线路等重要生产区域的安全状况;齿轮箱、发电机、叶轮、塔筒等机组重要部件的安全状况;重大危险源及特种设备的安全状况;各类电动工器具、安全工器具的检验及使用状况;
11.3 检查风机或作业区域内粉尘、照明、噪音、气味、辐射、高温、低温、毒物等影响人员健康的环境状况;
11.4 检查风机或作业区域内现场沟坑孔洞、平台栏杆步道等影响人员作业安全的设施状况;
11.5 检查设备检修作业、动火作业、进入受限空间作业、起重作业、高处作业、高边坡作业、临时用电等作业的危险点预控情况;
11.6 检查各类安全警示标志的管理和设置情况。
1.负责数字化项目全流程统筹管理,制定项目计划、分配资源、管控进度与质量;
2.负责统筹产品开发工作,结合应用架构需求制定开发方案,审核技术选型、核心代码及测试方案;
3. 负责产品运营策略制定,统筹用户反馈收集与分析,主导产品功能优化迭代规划并推动落地;
4.负责运维体系搭建与统筹管理,建立系统监控、故障处理及版本更新机制;
5.承接应用架构落地需求,协调开发与运维资源匹配实施计划。
1.负责新零售业务门店/仓库网络的日常运维、故障处理、应急响应,保障网络及相关业务的稳定运行,有能力处理突发事件、对疑难问题进行跟踪并最终解决。
2.负责新零售业务门店/仓库网络的开仓建设,对涉及到系统架构中存在的网络设计提出解决方案,与其他协同团队一起完成重点项目的实施、配置等服务交付。
3.负责新零售业务门店/仓库网络的质量监控及用户体验收集,监控告警、运维自动化平台的持续性建设及功能优化,不断提高网络质量。
4.参与自动化工具开发,对网络基础信息、资产、故障率、可用性、容量性能、成本等数据的运营和分析,提升网络稳定性和运维效率。
5.参与对新零售网络相关技术、产品与工具、行业最佳实践进行研究、测试及运用,有探索和实践精神,满足业务发展需求。
6.在日常运维过程中为一线服务团队提供标准、流程规范和指导文档。
1、供配电规划及水电气变更事项对接与跟进;
2、电力保障能力提升,电力安全检测管理;
3、中央空调系统、压缩空气系统和其他基础设备管理(制氮系统、直饮水系统、热水系统、电梯等);
4、用电监控与计量管理,用电分摊管理;
5、售电、省电节能项目跟进;
6、车间水、电、气 施工项目评估与验收;
7、电力、水电施工、装修装饰工程供应商管理;
8、上级安排的其他任务。
任职要求:
1、本科学历,电力工程或供配电相关专业优先;
2、逻辑思维能力强,统计分析能力强,有一定的计划、报告、总结经验;
3、具备良好的组织、沟通协调能力;
岗位描述
我们正在招聘智能运维开发工程师,负责阿里云大数据平台的智能运维体系建设,面向超大规模大数据平台、AI 平台及相关基础设施,持续提升系统稳定性、运维效率和平台自动化能力。
该岗位将深度参与大数据平台运维平台开发、稳定性治理、AI 化改造和智能运维 Agent 建设,围绕故障发现、问题诊断、容量水位、变更风险、发布管控、监控告警、自动化处置等核心场景,建设面向超大规模复杂系统的智能化运维能力。
你将与研发、SRE、平台工程、算法和产品团队协作,推动传统运维能力向平台化、自动化、智能化演进,支撑阿里云大数据平台及 AI 平台在大规模、高复杂度、高可用要求下稳定运行。
工作职责
1. 负责阿里云大数据平台智能运维体系建设,参与运维平台、稳定性平台、自动化工具、诊断系统等核心能力的设计与开发,提升平台化、自动化和智能化运维水平。
2. 参与智能运维 Agent 建设,结合大模型、RAG、工具调用、自动化编排和知识库能力,落地日志分析、指标分析、故障归因、异常检测、根因定位、SOP 执行和运维问答等 AI 化运维能力。
3. 负责超大规模大数据平台及 AI 平台的稳定性保障,围绕监控告警、故障诊断、容量水位、链路治理、变更风险、应急处置和复盘改进等场景,持续提升系统可靠性。
4. 参与大数据平台架构演进和稳定性治理,识别系统瓶颈与稳定性风险,推动容量规划、性能优化、资源治理、容灾高可用和架构改进。
阿里云智能-运维开发-AIOps Agent工程师(售后技术方向)
我们正在招聘运维开发工程师,负责阿里云大数据&AI平台的售后智能答疑体系和客户体感稳定性体系建设,从用户服务专家的视角来处理超大规模大数据平台承载的用户问题和重保需求,持续提升运维效率,为产品稳定性和服务口碑树立持续贡献力量
该岗位以大数据&AI产品售后答疑工作为业务基础,一方面深度参与共建Agent架构下的智能答疑能力,围绕问题自助答疑、自助诊断和产品改进项提炼等核心场景进行自动化能力建设;另一方面深度参与客户体感稳定性体系和重保能力建设,在对产品架构和稳定性场景深入掌握的基础上,提炼客户实例级稳定性指标,为客户提供更前置的主动隐患发现与重保服务能力
你将与TAM、研发、SRE、平台工程、算法和产品团队协作,推动传统答疑和排查能力向智能化演进,支撑阿里云大数据&AI平台业务高速发展,共建业界一流的智能服务专家团队
工作职责:
1. 负责阿里云大数据&AI产品的售后L3答疑和服务工作,承接前方服务团队的升级工单处理和用户疑难问题排查;组织和提供大客户钉群服务能力,对头部/重要客户进行业务保障;接收客户需求提供业务巡检、大促护航、产品改进推动等重保能力交付
2. 参与基于Agent的智能答疑体系建设,结合大模型、RAG、Skills、Harness engineer等技术能力,落地根因定位、异常检测、SOP执行和运维问答等AI化运维能力
3. 参与客户体感稳定性系统建设,协同产研SRE建立实例级可用率指标,定义客户级体感可用率标准,构建细粒度封网、变更后置、主动巡检和风险发现预防等重保能力,推动客户问题发现与主动服务链路落地,为产品提供更强的增值能力
4. 负责售后支持外包团队的管理,包括答疑提效、人员培养和成本管理等职责
1. 中间件运维与高可用保障:负责消息队列(Kafka/RocketMQ)、服务注册与配置中心(Zookeeper/Nacos)等核心中间件的稳定性维护、性能调优及高可用架构设计;基于Kubernetes完成容器化部署、弹性扩缩容、版本升级及日常运维,保障核心系统7x24小时稳定运行。
2. 故障排查与根因分析:通过日志分析、链路追踪及监控体系快速定位中间件相关故障(如消息堆积、服务注册异常等),主导问题修复与复盘;使用Java或Go开发调试工具,高效排查线上性能瓶颈及与业务系统的兼容性问题。
3. 性能优化与平台适配:测试并优化中间件在不同CPU架构、内核版本及容器环境下的性能表现,解决资源调度与性能瓶颈问题,持续提升中间件运行效率与资源利用率。
4. 负责搭建及使用SRE数字人实现线上运维智能化。


