虎牙
(2027届)AIGC语音大模型算法工程师
RESPONSIBILITIES
岗位职责
负责语音合成(TTS)核心算法研发,包括但不限于Zero-Shot语音克隆、音频标签(语速/音调/音量/情感)控制合成、高自然度音色定制、跨语言/跨情感泛化;
负责语音识别(ASR)及实时交互技术的研发,包括热词注入、轮次转换、说话人识别等方向;
持续优化合成语音的音质、自然度与情感表现力,主导音频标签体系设计与数据增广策略;
面向端/云侧业务场景,进行模型轻量化(TensorRT/ONNX量化、裁剪)与推理加速,保障线上稳定性;
主导音频生成技术在虎牙核心业务场景的落地交付,跟进并解决直播、数字人、硬件智能体等真实复杂场景下的技术挑战
REQUIREMENTS
任职要求
1、2027届硕士及以上学历,计算机科学、信号处理、人工智能等相关专业;
扎实的数学与算法基础,熟悉主流TTS/ASR算法架构(如CosyVoice、SeedTTS、DotsTTS等),了解离散音频表征(Audio Codec)、连续表征(VAE)、自回归/非自回归、扩散模型等技术范式;
熟练掌握PyTorch,具备良好的工程落地能力;熟悉C++/CUDA或有TensorRT/ONNX推理优化经验者优先;
强烈的责任心与自驱力,能洞察业务需求并将技术突破转化为产品价值;
具备大模型编码与研发能力。
加分项
在Interspeech、ICASSP、NeurIPS、ICML、ACL等顶会发表过语音/音频生成相关论文;
有语音合成/音频生成方向的高星开源项目或技术竞赛优异成绩;
有TTS数据标注体系设计或音频标签体系构建经验。
你将获得
从模型研发到线上部署的端到端实战经历;
直接影响亿级用户产品的技术挑战;
与资深算法工程师并肩作战的快速成长机会
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
