上海人工智能实验室
【实习】大模型评测实习生-大模型中心
RESPONSIBILITIES
岗位职责
评测体系构建:参与设计并执行文本、多模态大模型及智能体的评测框架设计,构建覆盖多场景的评测基准(Benchmark),并持续优化评测流程的效率与可靠性。
技术探索与集成:跟踪学术界与工业界的最新大模型及智能体评测方法与评测 benchmark,快速将其集成到现有平台。
评测结果分析:与大模型算法团队紧密协作,从评测结果中分析模型及智能体能力瓶颈,用于公开榜单与内部模型能力迭代。
跟踪AI领域前沿技术,团队协作,完成算法评测相关科研任务。
REQUIREMENTS
任职要求
计算机、人工智能或相关专业硕士及以上学历,具备算法理论基础。
具备丰富的大模型或 Agent 算法评测经验,熟悉其相关评测方法。
熟悉Python、GIt 等开发工具,了解 LLM、MLLM、Agent 部署等,了解自动化测试流程,了解容器化、沙盒、网络通信等。
在ACM/ICPC、Kaggle等编程或算法竞赛中获奖,或有开源项目贡献经验者优先。
在ICLR、ICML、NeurIPS、ACL等顶会顶刊发表过论文者优先。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
