招聘公告 · 职位检索 · 央国企/事业单位/名企

视频生成开源生态工程负责人 / Video Model Open Source & Inference Lead

单位:MiniMax类别:互联网 / 电子 / 网游类型:社招地点:上海更新:2026-09-24

岗位信息

招聘单位MiniMax
工作地点上海
官方更新时间2026-08-27 17:46:01

职位描述

负责将 MiniMax 视频模型从内部研发实现转化为全球开发者可以直接使用、部署和二次开发的开源模型,并推动模型进入主流开源框架和开发者工作流。我们希望你既能完成关键工程工作,也能代表 MiniMax 与全球开源 Maintainer 和技术贡献者协作。你将负责:

1. 模型开源适配

1)理解模型架构和内部推理实现,设计对外开源与框架接入方案;

2)完成或推动 ComfyUI Node、Diffusers Pipeline、权重转换和标准 Workflow 开发;

3)确保不同框架与原始实现之间的输出效果、精度和性能一致。

2. 推理与部署优化

1)分析模型的计算、显存和通信瓶颈;

2)推动量化、显存优化、模型加载优化及多卡推理方案;

3)解决不同 GPU、操作系统和推理后端中的兼容性问题;

4)建立可复现的 Benchmark 和性能评估体系。

3. 上游开源协作

1)与 ComfyUI、Diffusers 及其他基础设施项目 Maintainer 进行技术方案讨论;

2)编写符合上游要求的代码、测试、文档和 PR;

3)跟进 Code Review、CI、Release,推动官方支持落地;

4)Review 内部团队和外部 Contributor 提交的技术方案及代码。

4. 开发者技术交付

1)建设模型 Demo、部署指南、API 示例、FAQ 和故障排查文档;

2)处理开发者在推理、量化、部署和微调中的关键技术问题;

3)从真实使用场景中发现问题,并反哺模型和 Infra 团队。

任职要求

我们希望你:

1. 熟练使用 Python 和 PyTorch,具备扎实的模型工程能力;

2. 能够独立阅读和修改视频生成模型及推理框架代码;

3. 熟悉视频生成模型的 Text Encoder、VAE、DiT、Scheduler、Attention 等模块;

4. 实际使用或开发过 Wan、HunyuanVideo、CogVideo、LTX、Open-Sora 等模型;

5. 有 Diffusers、ComfyUI、量化、分布式推理或 GPU 性能优化经验;

6. 能独立定位 OOM、输出不一致、速度退化和框架兼容问题;

7. 有公开代码、技术文章、Benchmark 或开源贡献;

8. 英文能够满足开源技术协作需要。

【加分项】

1. 参与过视频模型从内部代码到公开发布的完整过程;

2. 做过原始 PyTorch 实现与 Diffusers/ComfyUI 实现之间的精度对齐;

3. 熟悉 FP8、INT8、INT4、Attention 优化及多 GPU 推理;

4. 在知名开源项目中担任过 Maintainer 或核心 Contributor;

5. 有大规模模型部署、性能分析或 GPU Infra 经验。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。