算法实习生(语音方向)
岗位信息
| 招聘单位 | 中科紫东太初 |
|---|---|
| 工作地点 | 北京、武汉 |
| 官方更新时间 | 2025-07-30 10:41:43 |
职位描述
负责语音大模型的研发,包括但不限于语音理解、语音合成方向等
参与语音大模型的数据准备和模型训练等
跟踪业界前沿技术,持续探索端到端技术的新能力和新应用,提升核心能力。
任职要求
【职位要求】
硕士及以上学历,计算机、数学、通信等相关专业;研究方向为语音合成、语音大模型、多模态等相关领域。
熟悉机器学习和深度学习理论,掌握生成模型、多模态大模型等一个或多个方向的理论与算法,具备相关方案实现能力与经验。
【技术能力】
熟悉端到端语音大模型结构(如Qwen-omni、Step-Audio、LLaMA-Omni、GLM-4-Voice等)
熟悉常见语音合成大模型(如CosyVoice、F5-TTS、Index-tts、MegaTTS3等)
熟悉Pytorch、Python、C++/C、Shell等,对数据结构和算法设计有深刻理解
熟悉基于LLM的语音合成、端到端方法,持续关注语音/NLP/多模态的前沿技术
【优先条件】
实习时间6个月,博士优先
具有良好的团队合作精神、技术热情和自驱力
有顶会论文(各类CCF-A、ICASSP、INTERSPEECH等)、具体实践项目、实验室背景优先
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。