黔西南布依族苗族自治州IT运维工程师
IT运维工程师是负责企业内部IT系统和网络设备的日常管理和维护的专业人员。他们需要监控和维护服务器、网络设备和软件应用,确保系统的稳定运行和安全性。此外,他们还需要负责故障排除、问题解决以及维护IT系统的日常运营,以保证员工能够有效地使用各种IT工具和应用。IT运维工程师还需要对新技术和系统进行调研和评估,并根据企业的需求进行部署和优化。他们还可能负责编写技术文档,培训员工以确保其正确使用IT系统。这个职位需要具备扎实的IT技术知识和问题解决能力,以及良好的沟通技巧和团队合作精神。
薪酬概览
平均月薪
¥5100
中位数 ¥0 | 区间 ¥3700 - ¥6400
数据来源:样本数量过少,仅供参考;更新时间:2026年7月13日
月薪分布
85.7% 人群薪酬落在 0-8k

三大影响薪酬的核心维度
影响薪资的核心维度1:工作年限
影响薪资的核心维度2:学历背景
市场需求
1月新增岗位
8
对比上月:岗位新增4
数据由各大平台公开数据统计分析而来,仅供参考。
岗位需求趋势
不同经验岗位需求情况
| 工作年限 | 月度新增职位数 | 职位占比数 |
|---|---|---|
| 1-3年 | 2 | 28.6% |
| 不限经验 | 5 | 71.4% |
热招职位
会计3-4K/月
1、负责公司的账务管理。
2、熟练掌握会计基础知识,能独立完成凭证填制,结账,出具会计报表,纳税申报。
3、有会计从业资格证,相关专业毕业,有相关工作经验者优先。
4、熟悉电脑,有责任心,成熟稳重,服从安排。
福利待遇:
1、每月休四天,法定节假日加班补助。
2、按国家规定购买工伤险。
3、有节日慰问金。
岗位核心价值
负责公司大算力 AI 集群(含 B/H 系列高端卡、国产算力卡)的架构设计、搭建部署、运维优化与国产化适配,支撑大模型训练、自动驾驶等核心业务的高效稳定运行,打造高可用、高性价比的算力基础设施。
核心工作职责
1. 大算力集群自建与架构设计:主导超大规模 AI 算力集群(数千 P 级)的自建规划,包括硬件选型(GPU/B/H 系列卡、国产卡等)、网络拓扑设计(InfiniBand/ROCE)、存储架构(分布式存储)、集群调度系统搭建,确保集群性能达标、扩展性强。
2. 高端 GPU 加速与优化:具备 NVIDIA B 系列、H 系列高端算力卡的实战经验,负责卡级性能调优、并行计算加速(TensorRT/MPI/NCCL)、显存优化,解决大模型训练 / 推理中的算力瓶颈问题。
3. 国产算力卡适配落地:主导国产算力卡(阿里PPU、华为昇腾等)的适配工作,包括驱动安装、框架适配(TensorFlow/PyTorch/MindSpore)、模型迁移与性能调优,实现国产算力与业务场景的深度融合。
4. 集群运维与稳定性保障:负责算力集群的日常运维,包括硬件故障排查、集群监控告警(GPU / 网络 / 存储状态)、资源调度优化、灾备方案设计,保障集群全年高可用性(99.9% 以上)。
5. 技术沉淀与迭代:跟进业界大算力集群技术趋势(如新型 GPU、网络协议、调度系统),输出技术方案与最佳实践;搭建集群运维自动化工具,提升运维效率。
1、对部署效率负责,对相关工具的建设负责,实现多产品组合一键部署,无人值守安装,落地基于不可变基础设施的部署方案;
2、负责运维体系建设,包括可观测性体系,北极星指标体系,CMDB,工单系统,作业平台等;
3、参与制定SRE相关的规范和流程,并负责推广落地;
4、负责SRE团队技能建设,团队技术分享、团队技术选型、团队技术培训等;
5、作为团队技术专家,负责解决重大疑难问题,团队知识库建设,故障复盘,常见问题沉淀,预案体系建设,混沌工程建设。
1. 协助运维人员进行服务器、网络设备、存储设备等设备的日常运维工作,并及时处理出现的问题;
2. 协助运维人员编写文档,记录相应的操作流程、日常工作和服务器的维护情况等;
3. 参与服务器应用的安装、维护和升级工作,通过对生产环境进行技术测试和排查异常,为公司IT系统的稳定运行做好技术支持;
4. 参与公司IT系统的监控、数据备份等工作,及时处理并防止系统出现故障。
工作内容:
1、负责日常资源交付、变更、巡检、告警处置与故障恢复工作,沉淀输出标准化操作流程;
2、参与可观测体系、容量管理、混沌工程、流量调度等方向的平台与体系持续优化演进;
3、主导基于大语言模型(LLM)的运维智能体(AI Agent)、AI工作流方案设计,落地运维数字人、AI巡检、AI根因分析等AIOps业务场景。
任职资格:
1、本科及以上学历,拥有3年及以上AI开发或运维相关工作经验;
2、熟练掌握Python/Go至少一门编程语言者优先;
3、熟悉Linux操作系统,了解Kubernetes(K8s)基础概念;熟练使用Prometheus、DNS、CDN、CICD、Nginx等常用中间件与服务,具备传统运维故障排查、自动化脚本编写实操能力;
4、了解可观测、容量管理、高可用容灾架构、混沌工程、流量调度相关知识,拥有大规模集群稳定性保障实战经验优先;
5、熟悉LangChain、LangGraph、Dify等主流Agent开发框架,掌握MCP、技能插件(Skills)、Prompt&RAP、多智能体规划相关技术;
6、具备优秀的问题拆解、逻辑分析、跨团队沟通协作能力,学习主动性强、自驱力突出。
工作内容:
1、负责日常资源交付、变更、巡检、告警处置与故障恢复工作,沉淀输出标准化操作流程;
2、参与可观测体系、容量管理、混沌工程、流量调度等方向的平台与体系持续优化演进;
3、主导基于大语言模型(LLM)的运维智能体(AI Agent)、AI工作流方案设计,落地运维数字人、AI巡检、AI根因分析等AIOps业务场景。
任职资格:
1、本科及以上学历,拥有3年及以上AI开发或运维相关工作经验;
2、熟练掌握Python/Go至少一门编程语言者优先;
3、熟悉Linux操作系统,了解Kubernetes(K8s)基础概念;熟练使用Prometheus、DNS、CDN、CICD、Nginx等常用中间件与服务,具备传统运维故障排查、自动化脚本编写实操能力;
4、了解可观测、容量管理、高可用容灾架构、混沌工程、流量调度相关知识,拥有大规模集群稳定性保障实战经验优先;
5、熟悉LangChain、LangGraph、Dify等主流Agent开发框架,掌握MCP、技能插件(Skills)、Prompt&RAP、多智能体规划相关技术;
6、具备优秀的问题拆解、逻辑分析、跨团队沟通协作能力,学习主动性强、自驱力突出。
1、支持行业云平台和云产品在不同芯片架构和服务器下适配的技术方案,推动多部门协同,解决软硬件技术问题,向用户提供自主可控,安全可信的行业云平台。
2、推动行业云横向架构治理,支持特定云产品线的多芯架构升级,包括安全合规、资源共池等,以满足各类行业标准和规范。
3、推动云产品在不同芯片体系下的性能调优和应用迁移技术方案,实现行业云平台的平滑迁移。
冷运项目运维专员面议
1、负责跟进公司项目客户订单端到端全生命周期的落地,如有异常及时介入干预;
2、定期与项目客户的相关人员进行沟通,掌握客户对我司服务的反馈;
3、拉通内部各部门对客户反馈的问题进行改善,并跟进改善效果;
4、对客户提出的新需求,拉通内部各部门给出解决方案,沟通客户确保方案的可落地性;
5、对客户的需求、异常工作形成台账,定期进行内部的汇报;
1、系统化学习与融入:
深入学习并掌握公司及部门的各项规章制度、安全规范、操作流程和企业文化;
全面熟悉蜀园社区的整体环境、设施设备布局、各功能区域及核心运行保障系统(强电、弱电、暖通、给排水、消防、楼宇自控等);
系统学习养老社区设施设备运维管理的专业知识、技术标准和最佳实践。
2、多模块轮岗实践:
根据培养计划,在运行保障部核心运维模块(包括但不限于强电系统、弱电系统、暖通空调系统、消防系统、中控室/BAS系统等)进行深度轮岗学习与实践;
重点学习掌握各模块设施设备的基础原理、操作规程、日常巡检、基础维护保养、常见问题识别与初步处理方法;
协助各模块工程师完成日常运维工作,积累实践经验(注:轮岗以学习实践为主,不涉及独立值班或强制夜班要求)。
3、项目实践与能力提升:
在资深工程师或项目经理的指导下,参与设施设备的性能优化、能效提升、预防性维护计划完善、运维流程梳理与改进等工作;
协助分析设备运行数据,识别损耗点,提出并参与实施降低运行成本、提高可靠性的方案;
学习项目管理的初步知识,参与项目计划的制定、执行、跟踪与总结。
4、综合能力发展与汇报:
定期总结轮岗及项目实践的学习成果、心得体会及遇到的问题,向上级领导汇报;
积极参与部门内外的技术交流与培训,持续提升专业技能和综合素质。
1、负责服务器操作系统的技术支持工作,为客户提供云操作系统故障诊断、问题分析、优化建议等服务2、深入分析客户在使用云服务器时遇到的相关技术问题,总结模型,沉淀工具和平台3、配合开发实施项目上线及交付4、系统基础服务架构优化5、云计算平台系统镜像管理6、云服务器初始化Agent及工具运维7、AI For OS智能化转型
1、负责私有云平台的全生命周期建设与维护,涵盖IDC机房基础设施、服务器硬件、底层虚拟化及容器化环境的稳定运行与资源调度;
2、负责应用全生命周期管理,包括代码构建、自动化发布、灰度上线、容量规划及性能调优,持续提升交付效率;
3、主导及参与运维自动化平台、AIOPS以及工具链的建设,通过代码化手段完善现有运维体系,推动运维自动化向智能化转型升级;
4、负责公司核心业务系统的部署上线、全链路监控分析、告警处理、故障根因排查及应急响应,保障业务高可用与SLA达成;
5、参与运维标准化流程(SOP)的制定与优化,负责运维知识库的沉淀、整理与完善,推动团队技术共享与能力提升。
1. 面向内部研发团队的工具开发和集成;
2. 面向内部研发团队的工具实施和维护;
3. 基于工具优化产品研发活动。
对无人车系统进行系统工程分析,与工程、产品和运营团队紧密合作,确保自动驾驶系统的完善设计和性能目标的实现:
运用功能安全与预期功能安全框架进行无人驾驶系统的风险评估与管理:使用FMEA,STPA,FTA和/或HAZOP等方法进行系统性的功能安全风险评估,结合SOTIF常用方法论中的场景分析、统计方法等评估和管理预期功能失效风险,并从系统层面牵头制定有效策略对已识别风险进行管理从功能安全与预期功能安全角度,参与制定无人驾驶系统验证策略、开发测试方法与测试集与关键系统指标牵头并协同各模块的安全工程师,开展兼容不同车辆平台的ADAS和AD系统架构的安全相关的分析与需求/设计,并将系统需求拆解至软件/硬件模块识别L4应用中的关键挑战场景,,向内形成完善的自动驾驶产品需求与系统需求支持Safety case的制作,研究/解读安全相关的ADAS和AD系统法规与监管要求与标准演进,协助在安全管理体系(SMS)框架下进行L4应用框架下的系统安全风险评估,支持项目组进行的安全/预期安全相关的对外沟通与认证工作
任职要求:
深入理解ADAS和AD技术领域的系统工程原理和方法,对软件功能、软硬件系统架构、应用层软件/中间件/底软、验证/准出指标等领域中的一项或若干项有较好了解,有在无人驾驶领域从事系统工程工作经验者优先深入理解功能安全和预期功能安全的方法论,并有落地实操经验具有较强的沟通能力与技术文档编写能力,能够清晰定义需求或评估风险,能基于业务需求,独立完成系统设计并导入给开发或能独立完成风险评估报告务实且富有创新精神,能够探索给出以合理资源解决复杂问题的技术方案对自动驾驶行业有强烈兴趣,对驾驶行为和新技术方向有敏锐的洞察力拥有工程、计算机科学或相关领域的学士或硕士学位具备与不同时区团队合作的灵活性
关于文远知行
文远知行WeRide(纳斯达克证券交易所代码:WRD)成立于2017年,是全球领先的自动驾驶科技公司,在全球9个国家30个城市开展自动驾驶研发、测试及运营,运营天数超1,900天,是唯一同时拥有中国、阿联酋、新加坡、美国四地自动驾驶牌照的科技企业。2024年10月月25日,文远知行正式在纳斯达克证券交易所挂牌上市,成为全球通用自动驾驶第一股、全球Robotaxi第一股。
文远知行致力于开发安全可靠的无人驾驶技术,应用场景覆盖智慧出行、智慧货运和智慧环卫,已进入自动驾驶商业化运营阶段,形成自动驾驶出租车(Robotaxi)、自动驾驶小巴(Robobus)、自动驾驶货运车(Robovan)、自动驾驶环卫车(Robosweeper)、高阶智能驾驾驶(Advanced Driver-Assistance System)等五大产品矩阵,提供网约车、随需公交、同城货运、智智能环卫、高阶智能驾驶解决方案等多种服务。
更多信息请访问:http://www.weride.ai,或关注官方微信号:文远知行WeRide
1、负责公司ERP及相关信息系统的日常运维;
2、负责及时跟进业务部门的需求变更,优化信息系统的使用;
3、负责编写相关需求文档、配合开发进行功能测试、编写培训文档并对用户进行各种培训;
4、协助IT负责人支持集团多家公司各类ERP系统的项目调研、实施、各模块操作使用流程优化、用户培训、日常使用支持及系统的权限管理、数据备份等运维工作。
5、负责参与制定ERP与各系统软件集成方案的编写




