上海人工智能实验室
【实习】大模型Agent审计与自进化算法-医学智能中心
岗位职责
开展大模型Agent评测、审计与自进化研究,探索Agent能力评估与持续优化关键技术。
研发Agent评测与审计系统,负责执行轨迹采集、自动化评测和实验平台建设。
设计过程级与结果级评测方法,分析Agent在规划、工具使用、推理、效率和鲁棒性等方面的表现。
探索基于轨迹、环境反馈和交互数据的自进化方法,推动Agent能力持续提升。
跟踪Agent前沿技术,参与论文、开源项目和技术成果产出。
任职要求
计算机科学、人工智能、数学、自动化或相关专业硕士及以上学历;特别优秀者可适当放宽。
熟悉Transformer、大语言模型和LLM Agent的基本原理,对Agent推理、工具调用、任务规划或模型训练有较深入的理解。
具备扎实的机器学习基础,熟练使用Python、PyTorch和Linux,能够独立完成模型训练、Agent实验、数据分析与问题诊断。
具备良好的科研能力,能够进行文献调研、实验设计、Benchmark构建、结果分析和技术写作,对实验结论保持严谨审慎。
具有较强的科研探索能力,对LLM Agent、Agent Evaluation 或 Recursive Self-Improving Agent等方向保持持续关注,能够独立提出问题并推动研究落地等方向有浓厚兴趣,具备良好的沟通协作能力和自主推进能力。 加分项
具有LLM Agent、大模型训练、强化学习、Agent Evaluation、自反思或自进化模型相关研究经验。
熟悉主流Agent框架, 对轨迹分析及数据合成有经验。
具有分布式训练、大模型推理系统、Agent Infrastructure或大规模评测系统的实践经验。
参与过有影响力的开源项目,或者在相关领域发表过高质量论文,具备良好的英文论文阅读和写作能力。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
