奇瑞汽车
主管工程师(强化学习算法)(J32710)
RESPONSIBILITIES
岗位职责
1强化学习算法研发与实现: 设计并实现 人在环中强化学习 算法,有效整合人类专家的监督、指导、评分和干预信号,以加速学习并保障安全。 设计并实现 仿真-真机交互学习 框架,构建仿真与真机之间高效、自动化的数据闭环。利用仿真器进行安全探索和策略预热,并将真机采集的数据反哺仿真模型,持续优化策略。 2安全在线强化学习系统构建: 开发适用于物理机器人的 安全在线学习 框架。重点研究基于模型的安全约束、风险感知探索和快速策略适应算法,确保机器人在学习过程中的自身安全和环境安全。 构建高效的数据管理、优先级回放和增量学习系统,以处理来自真机的实时数据流。 3大规模分布式机器人学习系统搭建: 搭建支持多台机器人并行进行数据采集与策略学习的软件架构。 优化仿真与真机之间的数据同步、策略部署和模型更新流程,实现全自动化、大规模的“学习-部署-收集”循环。 4系统辨识与仿真模型校准: 开发自动化的系统辨识工具,利用真机数据动态校准仿真器的物理参数(如摩擦、质量、延迟等),不断缩小 sim-to-real 差距。
REQUIREMENTS
任职要求
生源资质:博士及以上学历。
专业要求:计算机、人工智能、应用数学、统计学、机器人、系统科学等相关专业。
证书要求:能正常取得国家颁发的毕业证及学位证。
在校表现:在校期间担任学生干部、获得校级及以上荣誉者优先。
其他要求:身体健康,热爱汽车行业,乐于奉献,敢于挑战。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
