哔哩哔哩集团
算法工程师(多模态理解方向)【2027届】
RESPONSIBILITIES
岗位职责
负责多模态视频大模型(Video LLM)及核心视频理解技术的研发与迭代,聚焦长视频、细粒度、音视频精细化理解方向,持续挑战多模态基础模型的技术边界;
紧密跟踪视频理解与多模态大模型领域最新进展,推动研究成果向业务转化,并在计算机视觉/AI顶级会议(如 CVPR、ICCV、ECCV、NeurIPS 等)发表高水平论文;
将视频理解技术工程化落地于 B站多模态视频数据引擎、智能搜索与推荐、二创高光素材提取及内容审核等核心场景,解决超长视频解析效率、多模态语义精准对齐、分布式大规模训练与推理性能等实际业务痛点,打造行业领先的视频解析大模型基建体系
REQUIREMENTS
任职要求
1.2027届应届毕业生,计算机科学、人工智能、计算机视觉等相关专业本科及以上学历,具备扎实的机器学习、深度学习理论基础;
深入理解多模态与视觉大模型原理,熟悉大模型底层技术(如 Transformer、时空序列建模、并行自回归解码、多模态语义对齐等);在视频理解或多模态领域有前沿技术研究及论文发表经验,敢于挑战技术边界;
对主流多模态视频大模型架构有深入理解,熟悉长短视频理解评测体系(Benchmark),熟悉 Megatron-LM、ms-swift 等底层分布式大模型框架,具备大规模模型训练(含 SFT 与 RL 阶段调优)、多机多卡集群调度、推理加速优化及工程化部署的实战经验;
CVPR、ICCV、ECCV、NeurIPS、ICML、AAAI 等计算机视觉或 AI 顶会/顶刊发表过相关论文者优先;
熟练使用AI agent能力者优先
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
