阿里国际
大模型应用算法实习生(Agent训练/Agent自进化)-Accio Work
岗位职责
构建Agent自进化闭环系统:针对复杂商业场景,设计并研发具备自主进化能力的 Agent 框架,形成从任务执行到自我反思、经验总结、能力增强的完整闭环;
研发Agent自主学习与经验沉淀机制: --探索 Agent 在与环境交互中自主学习、自我改进的多元化路径; --研究长期经验沉淀算法,构建 Agent 可持续演化的能力底座,解决复杂任务流中的策略退化、长程优化等问题。
探索前沿Agent自演进路径: --研究自动化对齐、自主数据演化、指令自我迭代等方向,构建模型在弱监督乃至无人工干预下的自我演进机制; --探索启发式学习(Heuristic Learning)、自我博弈(Self-Play)等前沿技术,打造具备自驱动特征的智能体系统。
技术落地与业务实战:将自进化 Agent 算法应用于AccioWork等核心商业场景,沉淀具有行业影响力的技术方案与高水平学术成果。
任职要求
1、2027年3月及之后毕业,硕士及以上学历,计算机、人工智能、信息科学、数学、软件工程等相关专业优先;
在 NLP、大模型、Agent等领域有扎实的理论积累;
核心技术能力: --深入理解 Agent 演化机制,对自进化、Agent 长程任务执行等方向有实战经验或独到见解; --具备大模型强化学习方向的训练实践经验,理解主流训练范式与优化策略; --具备业务问题抽象能力,能将复杂商业场景下的痛点转化为可落地的算法问题;
前沿技术敏感度: --持续跟踪大模型自进化、自我改进等方向的前沿技术趋势; --关注自主智能体的最新进展,能快速复现并改进前沿算法。
加分项
在 NeurIPS, ICLR, ICML, ACL, EMNLP 等顶级会议发表过相关论文;
有高影响力 AI 开源项目贡献经验,或在相关领域竞赛中获得过顶尖名次。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。