VLM大模型数据运营专家(基础模型) - AI数据与安全
岗位信息
| 招聘单位 | 字节跳动 |
|---|---|
| 工作地点 | 北京 |
| 官方更新时间 | 2026-09-20 17:54:21 |
职位描述
团队介绍:AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。
团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。
1、主导核心方向数据生产全流程管控,对数据质量与交付效率负总责,紧密联动模型迭代环节,确保数据供给与模型效果优化同频共振;
2、结合视觉理解模型的核心能力场景,制定科学规范的数据生产标准与流程,并持续迭代优化,主动设计并落地数据生产效率提升、模型效果优化相关实验,输出客观严谨的结论并反哺流程升级;
3、探索并落地多元化标注提效方案,包括但不限于标注工具优化、提示工程(PE)撰写、Agent自动化标注搭建、标注模式创新等,提升数据生产效能;
4、深度协同算法、产品团队,精准理解模型原理与算法逻辑,针对性输出数据构造、生产策略等专业建议,助力打通“数据-模型-效果”的闭环链路;
5、承担团队知识输出与带教职责,协助非技术向成员提升大语言模型相关认知与实际应用技能,赋能团队整体业务目标达成。
任职要求
1、本科及以上学历,计算机科学、人工智能、数学、物理等相关理工科专业,熟悉视觉基础原理、接口技术及提示工程,有LLM/VLM标注方案构建经验者优先;
2、具备大模型训练、微调、应用开发或网页爬取等相关技术经验者优先;拥有扎实的计算机网络、多线程等知识基础,能熟练运用Python及Pandas、NumPy等三方库完成数据处理工作;
3、对前沿科技有强烈探索欲,主动追踪行业最新论文与研究成果,热衷于VLM、世界模型等领域,具备相关知识储备或实践经验者优先;思维灵活创新,敢于尝试多元路径解决问题;
4、具备出色的快速学习与深度理解能力,对数据质量有敏锐的洞察力,善于发现并解决问题,自驱力与执行力突出;
5、具备成熟的项目管理经验与方法者优先,能够独立完成项目立项、跨方目标对齐、标准统一、沟通机制搭建等工作,带领团队高效达成目标。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。