小鹏汽车
【27届校招】Research Scientist / Engineer(具身智能方向)
岗位职责
岗位简介 面向通用人形机器人及真实物理世界场景,参与打造行业领先的具身智能大模型。围绕多模态大模型(VLA / Omni / VLM / LLM 等)的研究、训练、工程化与端侧落地展开工作,推动模型与机器人感知、认知、决策、控制及人机交互系统的深度融合,构建面向真实场景的下一代智能体系统。 我们欢迎不同侧重的候选人:无论你更擅长前沿算法研究、大规模训练与工程化,还是系统集成与端侧部署,都能在这里找到合适的位置。 职位描述
前沿模型研究与打造:参与研究可泛化、可 Scaling 的多模态大模型(如 VLA、Omni 等),探索文本、语音、视觉、视频、动作等多模态信息的统一表征、理解、推理与生成,提升模型在开放环境下的通用智能与全身动作控制能力。
多模态感知与自然交互:研究融合语音、视觉、语言、表情、手势、姿态与动作的多模态交互算法,提升机器人在复杂场景下的感知、意图理解、对话决策与行为生成能力,打造自然、实时、拟人的交互体验。
大规模训练与数据体系:参与多模态数据构建与大规模训练、后训练、指令微调、偏好对齐、强化学习等技术研发,持续优化训练效率、稳定性与模型效果。
工程化、系统集成与端侧部署:与算法、感知、运动控制、硬件及测试团队紧密协作,推动模型与机器人软硬件系统的深度集成;探索模型压缩、量化、蒸馏、推理加速及端侧异构部署,持续优化时延、性能与稳定性。
技术影响力建设:紧跟国际学术界与工业界最新进展,通过算法创新、技术攻坚、论文专利及系统迭代,形成具有行业影响力的技术成果。
任职要求
教育背景:计算机、人工智能、自动化、电子信息、机器人、数学等相关专业,硕士及以上学历(研究或工程能力突出者可放宽)。
基础能力:具备扎实的机器学习/深度学习基础,在 VLM、LLM、多模态、语音、RL、Robotics、3D Vision、AIGC 或人机交互等方向中的一个或多个有研究或实践经验。
工程能力:熟练掌握 Python / C++ 与 PyTorch 等主流框架,具备良好的算法实现、系统调试与代码工程能力;熟悉 Linux 环境者优先。
专业方向(以下任一即可):
研究向:具备独立开展高水平研究的能力,在 CVPR / ICCV / ECCV / NeurIPS / ICLR / ICML / CoRL / ICRA / SIGGRAPH 等顶会顶刊发表过论文者优先。
工程/落地向:具备大规模分布式训练、训练平台、推理优化或端侧异构部署(如 TensorRT / ONNX、Docker / K8s 等)经验,具备真实场景算法落地与系统性优化能力者优先。
综合素质:对具身智能与机器人有浓厚兴趣,具备良好的跨团队沟通协作与复杂问题解决能力,能在“研究—工程—平台—产品”多方之间高效推进项目。 加分项
有机器人、人机交互、数字人、智能音箱、车载交互、自动驾驶或多模态智能体等相关项目经验。
熟悉 ASR / TTS / VAD、声源定位、视觉语言模型、对话大模型、生成式动作模型或流式多模态建模。
熟悉 ROS / ROS 2、机器人传感器及“感知—决策—控制”系统。
有实时音视频处理、模型量化、推理加速或端侧部署经验。
有代表性开源项目、技术竞赛成果或完整大模型研发经验。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。