Token Foundry
世界模型视觉算法研究与应用-阿里星
RESPONSIBILITIES
岗位职责
负责世界模型的基础视觉算法研发,包括视觉数据算子、视觉表征学习、跨模态对齐与融合等核心能力建设;
探索适合理解与生成统一建模的视觉编解码架构,推动图像、视频、3D及4D动态场景的统一表征与生成;
开展3D/4D视觉算法研究,包括多视角几何、深度估计、三维重建、动态场景建模、神经渲染及空间智能等方向;
研究世界模型中的环境感知、空间智能、状态表征、物理规律学习、未来预测与交互式生成,提升模型对真实世界的理解、推演与模拟能力;
REQUIREMENTS
任职要求
计算机视觉、机器学习、人工智能、计算机图形学、机器人等相关专业硕士及以上学历;
具备扎实的数学与理论基础,熟悉概率统计、优化方法、深度学习、三维几何及生成模型相关理论;
熟悉3D或4D视觉技术,包括但不限于多视角几何、SLAM、点云处理、三维重建、NeRF、3D Gaussian Splatting、动态场景重建、神经渲染或三维生成;
具备丰富的NLP与CV交叉领域积累,理解多模态预训练、跨模态对齐、视觉指令微调及统一理解与生成建模;
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。