Token Foundry-语音合成与音频生成大模型算法专家-Qwen Audio
Company 通义实验室
Focus 技术 · 算法
北京, 杭州
July 29, 2026
岗位职责
1.参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等。 2.探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现。 3.针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题。
任职要求
1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。 2.具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术。 3.熟练至少一种大模型训练框架(Deepspeed, Megatron),有大模型训练经验。 4.有较强的学习能力和问题解决能力,有自驱力,能快速掌握新技术并应用于实践。 5.发表过相关领域顶级会议论文(NeurIPS、ICML、ICLR、ACL、Interspeech、ICASSP等)、参与行业有影响力项目或者ACM竞赛获奖者优先。
岗位标签
NEW