招聘公告 · 职位检索 · 央国企/事业单位/名企

混元vlm算法研究员-后训练/基座能力提升方向(深圳/北京/上海)

单位:腾讯类别:技术类型:社招地点:北京更新:2026-09-24

岗位信息

招聘单位腾讯
部门/事业群TEG
所属产品混元-模型算法
工作地点北京
经验要求三年以上工作经验
官方更新时间2026年08月17日

职位描述

1.主导后训练研发体系:负责多模态大语言模型(VLM)的后训练(Post-training)全流程算法研发,深入探索 SFT 及强化学习对齐算法(如 RLHF、PPO、GRPO 等),持续逼近并提升视觉基座模型的能力上限;

2.攻坚视觉基础感知:致力于优化模型底层的视觉感知、细粒度理解与空间感知能力。前瞻性地探索包括“带图思考”在内的 Visual Agent 解决方案,赋予模型更深层次的物理世界理解与执行能力;

3.提高大模型可靠性:致力于大幅度降低多模态大模型幻觉。深入探究幻觉产生的本质,建设完善的幻觉检测链路,实施精细化的数据清洗策略,并主导研发基于强化学习的幻觉消除(Hallucination Removal)方案;

4.赋能用户交互场景:面向真实用户场景进行模型对齐与调优,强化模型在多轮图文交互中的逻辑推理、指令遵循(Instruction Following)以及细节感知能力。搭建线上 Badcase 监控与数据飞轮反馈闭环,持续打磨并打造极致的交互体验。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。