vivo
语音识别算法工程师-实习
RESPONSIBILITIES
岗位职责
语音识别技术研发:设计并优化基于LLM的语音识别大模型,解决发音模糊、方言&口音、噪声环境(如会议室回声、环境杂音)、上下文幻觉的识别难题,提升识别准确率与响应速度;
说话人日志技术突破:研发前沿大模型说话人日志方案,突破角色分离效果上限;
流式识别技术预研:研发低延迟高精度流式识别大模型方案,解决低延迟识别不准确的问题;
技术调研与创新:关注语音技术领域前沿动态(如 ICASSP、INTERSPEECH顶会成果),调研行业先进方案,推动新技术(如多模态语音识别、语音对话)在业务中的试点与应用。
REQUIREMENTS
任职要求
硕士及以上在读,计算机科学与技术、电子信息工程、自动化、人工智能、声学等相关专业,至少实习3个月,每周出勤5天;
掌握语音交互基础:了解信号处理等声学技术,了解语义VAD、打断检测、语音识别、合成、对话等前沿语音技术;
精通模型与算法:熟练使用PyTorch深度学习框架,深入掌握LLM ASR、LLM等前沿算法;
软技能要求:具备良好的问题分析与解决能力,能快速定位技术瓶颈;有较强的跨团队沟通能力,可高效协同产品、开发团队推进项目;对技术有热情,具备自主学习与创新意识;
加分项:
有顶会(ICASSP/INTERSPEECH/NeurIPS/ICML 等)论文发表;
精通实时语音交互系统研发;
具备大规模语音数据处理(数据清洗、标注、增强)的实战经验;
掌握多模态技术(如Qwen3 Omni),语音对话或熟悉前沿语音技术项目(如Qwen3 ASR/FireRedASR/Kaldi/K2等)。
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
