云尖信息
AI平台研发工程师022
RESPONSIBILITIES
岗位职责
负责大模型的部署、优化和维护,包括但不限于:基于现有的硬件平台(GPU服务器等),进行算力评估和资源规划。搭建和维护GPU集群,进行算力资源的管理和监控。使用vllm、sglang、ollama等工具对大模型进行推理优化,提升模型推理速度和效率。监控模型运行状态,及时发现和解决问题。
研究和探索最新的大模型部署技术和优化方法,研究跟进模型量化等技术,以及提升模型推理速度的相关技术体系,在实际工作中落地。
负责算力调度管理平台产品的设计开发,持续跟踪业界算力调度管理平台方案,打造先进的算力调度平台产品。
REQUIREMENTS
任职要求
精通云原生、微服务架构,熟悉K8S、算力调度、分布式系统,有大型算力平台、云平台、资源调度平台研发经验。
熟悉Linux操作系统,具备扎实的编程基础,有Vibe Coding及前后端全栈能力者优先。
熟悉深度学习框架,如TensorFlow、PyTorch等。
熟悉大模型部署流程,有实际的大模型部署和优化经验。
熟悉GPU架构,熟悉vllm、sglang、ollama等推理优化工具,有实际使用经验者优先。
熟悉Kubeflow、volcano调度、Hami、GPUStack平台技术者优先。
具备良好的问题分析和解决能力,能够独立完成任务。具备良好的沟通能力和团队合作精神。对大模型技术充满热情,乐于学习和探索新技术。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
