Rokid
系统运维工程师
RESPONSIBILITIES
岗位职责
负责自建私有云平台(基于开源生态)的架构规划、部署实施及全生命周期管理,确保集群的高可用性与资源利用率与日常维护
参与公有云平台向自建私有云的业务迁移工作,确保迁移过程安全可控
负责CPU、GPU等服务器的日常运维、驱动管理及故障处理
负责Linux系统日常巡检、性能调优及内核级问题定位与解决
编写运维自动化脚本(Shell/Python),维护Prometheus/Grafana监控告警体系
REQUIREMENTS
任职要求
本科及以上,5年以上Linux运维经验,有私有云(OpenStack/KubeVirt)或其他集群建设经验者优先 ● 深入理解Linux操作系统原理,熟悉内核参数调优及常见性能问题排查(CPU、内存、磁盘I/O、网络),能独立定位系统层面的性能瓶颈 ● 熟悉Shell/Python脚本编程,具备自动化运维能力,熟悉Ansible/SaltStack等自动化工具 ● 熟悉Kubernetes、Docker容器化技术及常见监控系统(Prometheus/Grafana) ● 有GPU集群运维经验或私有云建设经验者优先,具备良好的沟通能力和服务意识,能有效支撑研发团队的运维需求 ● 有扎实的网络运维经验优先,熟悉TCP/IP协议栈及VXLAN/BGP等数据中心网络技术,能配合网络岗定位丢包/延迟问题 ● 责任心强,能适应7×24小时值班轮转制度,在突发故障时能冷静、快速响应
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
