上汽乘用车
AI大模型评测工程师
RESPONSIBILITIES
岗位职责
搭建车载端侧LM/VM/Omni大模型、System Agent、业务智能体全维度评测体系,设计对话、视觉、任务执行评测用例。
针对模型准确率、响应时延、内存占用、功耗、场景鲁棒性、多轮对话逻辑开展自动化+人工评测。
联动需求、框架、智能体、模型部署团队,输出评测报告,定位模型/Agent缺陷,跟踪优化迭代闭环。
开发AI自动化评测脚本、测试工具,构建座舱场景评测数据集,持续扩充复杂出行、极限边界测试用例。
制定AI座舱模型与智能体评测标准、准入门槛,支撑整车AI功能Release版本质量把关。
REQUIREMENTS
任职要求
本科及以上人工智能、计算机、测试相关专业,2年以上大模型/车载AI评测工作经验。
熟悉LLM、多模态模型、智能体能力评价指标,可独立设计覆盖全场景的评测方案。
掌握Python自动化脚本开发,了解车载测试流程,能搭建简易自动化评测工具链。
具备数据分析能力,可通过评测数据定位模型推理、Agent调度、交互链路问题。
有8797平台车载AI评测、座舱多智能体测试项目经验优先。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。