好未来
语音合成算法工程师
RESPONSIBILITIES
岗位职责
承担教育场景下的语音合成,负责 TTS 前端、声学模型、声码器等核心模块的算法设计与改进,提升合成语音的自然度、流畅度与情感表现力。 负责 TTS 数据预处理、模型预训练、微调及强化学习相关工作,完成模型性能评估与迭代优化。 研究并实现段落或篇章级的韵律建模方案,优化长文本语音合成中的停顿、重音及情感表达。 推动语音合成技术在公司产品中的应用,针对业务场景进行模型调优与效果优化,支持个性化及情感合成的业务需求。 跟进语音合成的最新动态,包括大模型 TTS、Flow Matching、Diffusion-based TTS 等,探索创新方案并推动其在实际场景中的落地。
REQUIREMENTS
任职要求
学历要求:硕士及以上学历,计算机科学、信号处理、电子信息、模式识别相关专业优先。 在语音合成(TTS)方向有1-3年的工作经验,有工业级 TTS 系统上线经验,并熟悉语音合成质量评估方法(如 MOS、AB 测试等)。 深入理解 TTS 原理,具备篇章级韵律建模与情感语音合成研发经验优先。 熟悉 Python 编程语言,精通 PyTorch 框架,具备大规模分布式模型训练经验。 加分项: 具备端到端语音大模型(Speech + Text 联合训练)的训练与调优经验; 有语音编解码器(如 Audio Codec、Neural Audio Codec)的实践研发经验; 有语音技术相关论文在 Interspeech、ICASSP 等顶级学术会议发表;
具备优秀的问题解决能力与团队协作精神,能积极应对技术挑战并推动任务目标的顺利实现
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。