浩鲸科技
强化学习运控算法工程师(J17573)
RESPONSIBILITIES
岗位职责
岗位职责
聚焦机器人操控、运动控制、导航场景,开展深度强化学习(DRL)算法的研发、调试与落地,重点推进Sim-to-Real迁移技术在真实机器人硬件上的规模化应用。
设计并优化大规模并行仿真训练平台(如Isaac Gym、MuJoCo、Brax等),提升算法训练效率与策略泛化能力,支撑算法快速迭代。
与感知、规划、控制等跨部门团队深度协作,完成强化学习策略与机器人完整系统的集成、调试,保障技术落地效果。
搭建并完善RL训练基础设施,重点攻克reward shaping、curriculum learning、domain randomization等关键模块,夯实算法研发基础。
REQUIREMENTS
任职要求
任职要求
学历要求:计算机科学、人工智能、机器人学、自动化或相关领域硕博士学位。
经验要求:3年以上强化学习(RL)领域研究和工程经验,其中至少2年深度强化学习在机器人或物理仿真场景的实战经验(拒绝纯理论、纯非机器人场景RL从业者)。
算法能力:精通PPO、SAC、TD3、DDPG、DreamerV3、Decision Transformer等主流RL算法,熟悉其理论基础,且具备扎实的工程实现能力(能独立完成算法落地)。
工具/经验要求:熟练使用Isaac Gym、MuJoCo、PyBullet、Gazebo等至少一种主流机器人仿真环境,具备Sim-to-Real迁移实战经验(核心加分项)。
软素质:具备优秀的跨团队沟通协调能力,良好的英文读写能力,能适应国际化团队协作模式,高效推进跨部门项目。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。