招聘公告 · 职位检索 · 央国企/事业单位/名企

AutoTraining 工程师/研究员

单位:面壁智能类型:社招地点:北京更新:2026-09-24

岗位信息

招聘单位面壁智能
工作地点北京
官方更新时间2026-08-23 20:30:58

职位描述

我们正在构建以数据为核心的自动化模型增强系统:为后训练生成高质量数据、筛选高价值样本,持续提升模型能力。现有数据远未触及模型的能力上限,数据的构造、评判、配比与闭环仍有大量空白,等你来定义。

工作内容

-数据合成与构造:设计并实现高质量训练数据的生成链路(模型自生成、教师蒸馏、任务改写、难度爬升、多样性扩展等),持续扩充数据的覆盖面与深度

-数据质量与筛选:搭建数据裁定与清洗机制(规则校验、执行验证、模型评判、去污染、去重),把数据质量标准沉淀为可复用、可度量的规范

-SFT 训练与迭代:负责监督微调的实验设计、训练调优与效果归因,探索数据配比、课程式训练、多轮蒸馏等提升手段

-自增强闭环建设:将生成、筛选、训练、评测、回流打通为自动化流水线,减少人工介入,提高迭代效率

-前沿跟进:跟进并复现数据合成、蒸馏、self-improvement、post-training 等方向的最新工作,评估是否引入现有链路

任职要求

-专业与背景不限;学习能力强,能应对开放性问题和高不确定性的研究任务

-在数据或工程方向至少一项有突出能力:能从样本设计层面提升模型效果,或能独立搭建稳定高效的数据与训练链路

-具备数据判断力:能从样本、模型输出和评测结果中发现问题

-对数据驱动的模型增强、自进化系统、AI4AI 方向有浓厚兴趣

加分项

-熟悉大模型 post-training 流程,理解 SFT 的训练机制、数据格式与常见失效模式

-熟悉主流训练框架(如 ms-swift、LLaMA-Factory、DeepSpeed、Megatron 等)及分布式训练

-有 Agentic Coding、代码生成、SWE-bench / HumanEval / MBPP 等任务的训练或评测经验

-熟悉评测体系搭建,理解数据污染、评测可复现性等问题并有实际处理经验

-在相关方向发表过论文,或有优秀的开源项目、竞赛成绩、可展示的研究成果

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。