招聘公告 · 职位检索 · 央国企/事业单位/名企

大模型数据工程师 - Seed Model

单位:字节跳动类别:大数据类型:社招地点:北京更新:2026-09-24

岗位信息

招聘单位字节跳动
工作地点北京
官方更新时间2023-08-30 17:49:11

职位描述

团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。

Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。

1、参与设计实现高性能、可扩展、分布式的数据基建,涵盖数据存储、采集、清洗、标注、管理、分析等全生命周期,持续提升数据工作效率;

2、参与音视频多模态训练数据策略设计,开发高效的数据处理、合成、优化算子和流水线,构建多模态数据资产库,保障大模型研发的数据需要;

3、结合Agent,构建“数据-模型-评测”闭环,通过数据驱动大模型快速迭代;

4、追踪大模型数据领域前沿技术与方法,探索数据增强、数据蒸馏、高质量数据筛选等创新方案,落地到实际业务场景,提升数据价值。

任职要求

1、本科及以上学历,计算机、数学、人工智能等相关专业,在音视频、文本大模型等一个或多个领域有较深入的经验;

2、熟练掌握C/C++、Python、Go等至少一门编程语言,熟悉Ray、Spark相关技术栈;

3、熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈;

4、有大模型研发经验,参与过有行业影响力的项目者优先;

5、具备良好的沟通协作能力与团队意识,工作积极主动,愿意主动学习新技术、探索新方向,与团队共同推进技术突破。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。