宁德时代
IT工程师(AI Infra 平台与基础设施方向)
岗位职责
设备与网络运维:负责实验室及办公区 GPU 工作站、服务器、交换机等硬件的部署、监控、故障排查与日常维护;管理内部网络配置、IP 分配、VLAN 划分及基础安全策略;
算力资源调度:搭建并维护 GPU 算力调度系统(如基于 Slurm、Kubernetes 或自研平台),实现资源分配、使用监控、配额管理与用户隔离;
平台开发:开发内部工具平台的前后端功能,包括任务提交界面、资源看板、用户管理、日志查询等;
API 服务构建:设计并实现 RESTful API,支持算法、科研团队自动化调用算力、存储及开发环境服务;
开发者支持:协助团队成员配置开发环境、调试代码、接入集群,提升整体研发效率
任职要求
计算机、网络工程、电子信息或相关专业本科或研究生学历,具备2年以上工作经验;
熟悉 Linux 系统管理(Ubuntu/CentOS),能熟练使用 Shell/Python 进行自动化运维;
具备基础网络知识:了解 TCP/IP、DNS、DHCP、VLAN、SSH、防火墙等,能完成小型局域网部署与排障;
掌握 Python,有使用 FastAPI/Flask/Django 等框架开发后端服务的经验;
有前端开发能力,能使用 React、Vue 或类似框架构建简单管理界面;
熟悉 RESTful API 设计,了解数据库(如 PostgreSQL/MySQL)和缓存(Redis)的基本使用;
了解 Docker 容器技术,对 GPU 调度(如 NVIDIA 驱动、nvidia-smi、MIG)有基本认知;
责任心强,具备良好的沟通能力和多任务处理能力,能快速响应团队需求。 加分项(Nice-to-Have):
有 Slurm、Kubernetes、Ray 或其他调度系统部署经验;
熟悉 Zabbix/Prometheus/Grafana 等监控工具;
有 JupyterHub、MLflow、VS Code Server 等科研开发环境部署经验;
具备基础硬件知识,能处理网络、工作站等相关任务;
对 AI/ML 工作流感兴趣,愿意深入科研场景提供技术支持
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
