混元大模型数据策略产品(Stem/Reasoning方向)(北京)
岗位信息
| 招聘单位 | 腾讯 |
|---|---|
| 部门/事业群 | TEG |
| 所属产品 | AI |
| 工作地点 | 深圳 |
| 经验要求 | 三年以上工作经验 |
| 官方更新时间 | 2026年09月22日 |
职位描述
1.需求澄清与策略制定:与算法团队深度对齐数据目标,基于模型评测和 Badcase 分析,拆解 STEM / Reasoning 能力短板(如数学推理、代码生成、逻辑链条、工具使用等),将模糊的模型需求转化为可执行、可量化的数据需求,制定并持续迭代整体数据构建策略(含真实数据获取、合成数据等);
2.数据产线全流程设计:设计数据生产交付链路及核心环节(采集/清洗/标注/合成/质检/交付),定义数据标准、标注规范与质量验收标准,主导数据项目的发起、优先级判定与全流程管理,保障高质量数据的规模化、稳定交付;
3.质量与效果评估闭环:建立可量化的数据质量评估体系,跟踪数据交付后的训练收益;开展模型效果深度分析,联动算法团队定位数据侧的改进点,形成"数据生产 → 训练验证 → 策略迭代"的闭环;
4.模式创新与前沿探索:用大模型和 Agent 化工作流赋能数据生产(如数据合成、自动质检、Agent as a Verifier),推动数据产线的自动化与规模化;持续追踪业界数据领域前沿(数据配比、数据合成、课程学习等),将有效方法落地到实际产线。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。