招聘公告 · 职位检索 · 央国企/事业单位/名企

产品运营-大模型评测(J12677)

单位:智慧芽类型:社招地点:苏州市更新:2026-09-24

岗位信息

招聘单位智慧芽
工作地点苏州市
官方更新时间2026-07-20T16:30:22

职位描述

1. 负责大模型评测体系(Benchmark)在 GitHub、Hugging Face、Discord、知乎、X(Twitter)等国内外技术社区的日常运营与维护。

2. 策划并执行开源项目增长策略,提升项目的关注度、下载量、引用率及活跃贡献者数量。

3. 构建基于 AI Agent 的社区自动化运营工作流,提升社区响应效率与用户体验。

4. 结合评测榜单更新、新功能发布及行业热点,策划高质量的技术博客、Release Notes、使用教程及深度解读文章。

5. 利用 AI 生产力工具(文本/图像/视频生成模型)实现多语言内容的规模化、高质量产出与本地化分发,大幅提升内容运营的杠杆率。

6. 策划并组织线上/线下的技术布道活动,如 Webinar、黑客松(Hackathon)或打榜挑战赛。

7. 利用大模型对海量社区反馈、开发者舆情、竞品动态进行自动化抓取与情感分析,提炼核心洞察,为 Benchmark 的迭代方向提供业务输入。

8. 追踪国内外大模型评测领域的最新动态与竞品动作,输出行业观察报告。

9. 拓展并维护与高校科研院所、AI 头部企业、开源基金会及技术 KOL 的合作关系,推动联合评测或学术引用。

10. 打造该 Benchmark 在大模型领域的权威性和公信力,将其建设为行业标准的评测基座。

任职要求

任职资格

1. 本科及以上学历,计算机、人工智能、市场营销或相关专业优先。

2. 3-5年以上技术运营、开发者关系(DevRel)或开源社区运营经验。

3. 有成功的 GitHub 开源项目运营经验,或在 Hugging Face、Kaggle 等 AI 社区有丰富的运营/打榜组织经验。

4. 熟悉大语言模型(LLM)的基本概念、发展趋势及主流生态,了解 Benchmark 在模型研发中的价值与痛点(懂 MMLU, CEval, LMSYS Chatbot Arena 等榜单的运营逻辑)。

5. 具备优秀的技术理解力,能够与算法工程师无障碍沟通,并能将硬核技术转化为易于传播的社区语言。

6. 具备出色的中英文读写能力,能够熟练使用英语在国际社区(如 Hugging Face, X, Reddit)进行内容发布与深度用户互动。

7. 对 AI 领域的最新进展(新模型发布、新架构、新评测维度)有极强的求知欲和敏锐度,是 AI 前沿资讯的“重度消费者”和“尝鲜者”。

8. 熟练掌握并高频使用主流大模型及 AI 生产力工具,具备优秀的 Prompt Engineering 能力。

9. 能够主动用 AI 改造传统的运营、内容创作和数据分析工作流,实现个人与团队产出的指数级跃升。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。