传音
算法工程师-语音合成(J20229)
RESPONSIBILITIES
岗位职责
负责语音合成(TTS)核心算法的研究、迭代与落地优化,参与端到端TTS模型的训练、调优与改进,提升合成语音的自然度、清晰度、流畅度。
参与语音数据的清洗、筛选、标注、预处理及数据集搄建工作,结合业务场景优化数据质量,支撑模型高效训练与迭代。
跟进业界前沿的语音合成、语音生成大模型技术,开展技术调研、复现与创新实验,沉淀可落地的技术方案,推动算法性能升级。
配合产品、工程落地团队完成算法移植、适配与上线测试,解决落地过程中的实际问题,保障线上效果稳定。
REQUIREMENTS
任职要求
数学、计算机、自动化、信号处理等相关专业硕士及以上学历;
了解语音发生机理,对语音信号处理有一定基础,如基频检测跟踪、变速变调等;
熟练掌握Python,至少熟练使用一种深度学习训练框架,如Tensorflow、Pytorch等;
理解TTS原理,熟悉开源架构Cosyvoice系列、IndexTTS系列、F5-TTS等,以及声码器HifiGAN、BigVGAN等优先;
熟悉TTS前端Cleanser、TN、G2P等优先;
信息来自企业官方招聘渠道
OfferSeek 对公开岗位信息进行聚合、去重和结构化整理,最终申请以企业官方页面为准。
