奇瑞汽车
AI算法工程师-多模态方向(J33685)
RESPONSIBILITIES
岗位职责
负责多模态大模型(视觉-语言、图文理解等)的算法研究与开发,跟踪CLIP、LLaVA、Qwen-VL等前沿模型的技术演进。
参与多模态大模型在自动驾驶场景(如视觉感知、场景理解)和智能制造场景(如工业质检、缺陷检测)中的应用落地。
负责多模态数据的预处理、清洗、标注与增强,优化数据质量以提升模型泛化能力。
参与模型的训练、微调(Fine-tune)与推理优化,探索RAG、Agent等架构在多模态场景中的应用。
跟踪多模态大模型领域最新研究成果,在顶会(CVPR、ICCV、ACL等)发表高质量论文或申请技术专利。
REQUIREMENTS
任职要求
1、2026年1月1日-2027年8月31日毕业,博士学历,计算机视觉、自然语言处理、人工智能等相关专业,在视觉-语言预训练、跨模态对齐与表征学习等方向有深入研究;
精通Python编程语言,熟练使用PyTorch、TensorFlow等深度学习框架,熟悉Transformer架构及多模态大模型(CLIP、LLaVA、Qwen-VL等)的原理与训练流程;
在CVPR、ICCV、ACL、NeurIPS等国际顶级会议以第一作者发表过高质量论文,或在国际知名竞赛中取得优异成绩;
具备良好的英文文献阅读与学术写作能力,能快速跟踪并复现前沿算法,有独立开展科研工作的能力;
有工业界合作经验、开源项目贡献,或对自动驾驶、智能制造场景有浓厚兴趣者优先。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
