卓驭
多模态大模型后训练算法岗(领航者实习)
RESPONSIBILITIES
岗位职责
构建下一代具备通用场景移动能力的大模型,负责移动基座多模态大模型的后训练(Post-Training)技术研发,包括SFT、RLHF/RLAIF、DPO、Agentic RL等技术的迭代优化,提升模型在真实移动场景中的任务完成能力;
构建面向移动场景的指令数据集,设计任务多样化的微调策略,提升模型在端侧交互、场景理解、任务执行等方面的指令遵循能力,支撑复杂移动指令的准确理解与执行;
通过SFT、RL等手段,结合人类反馈与环境反馈优化模型决策能力,持续Scale Up模型在移动任务上的性能表现,推动通用移动能力的边界拓展;
探索模型轻量化与高效推理方案(如LoRA、QLoRA、KV-Cache优化、投机解码等),支持大模型在移动设备上的工程化部署,让通用移动能力可落地、可规模应用。
REQUIREMENTS
任职要求
计算机科学、人工智能、机器人等相关专业本科及以上学历,具备大模型微调或强化学习项目经验;
熟练掌握SFT、RLHF、DPO等后训练技术,了解对齐过程中模型行为变化的内在机理;
熟悉LoRA/QLoRA/Adapter等参数高效微调方法,具备模型量化、剪枝、蒸馏等压缩技术的实践经验;
具备良好的代码能力(Python/PyTorch)和数据分析能力,熟悉移动场景业务需求,有智驾,机器人等端侧模型经验者优先。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。