微信-语音全双工对话大模型预训练算法工程师
岗位信息
| 招聘单位 | 腾讯 |
|---|---|
| 部门/事业群 | WXG |
| 所属产品 | 微信AI助手 |
| 工作地点 | 北京 |
| 经验要求 | 不限 |
| 官方更新时间 | 2026年08月18日 |
职位描述
1.负责语音全双工对话大模型的架构设计与预训练,构建边听边说、实时打断、自然接话和连续对话能力;
2.负责音频理解模型预训练,提升语音内容、说话人、情感语气、副语言信息、环境声音及多人重叠语音的理解能力;
3.负责音频生成模型预训练,研究基于 Audio Token、Neural Codec、自回归、Diffusion 或 Flow Matching 的语音生成方案,提升音质、自然度、情感表现和生成稳定性;
4.负责全双工交互行为建模,包括回复时机、用户打断、抢话与让话、Backchannel、重叠语音和流式生成;
5.负责大规模音频预训练数据建设,包括数据清洗、去重、质量过滤、伪标注、Token 化及数据配比;
6.负责模型规模化训练、效果分析及训练稳定性优化,推动预训练模型的后训练、评测和产品落地。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。