AI 研发工程师(大模型应用)
岗位信息
| 招聘单位 | 面壁智能 |
|---|---|
| 工作地点 | 北京、上海、深圳 |
| 官方更新时间 | 2026-09-16 14:30:11 |
职位描述
1. 负责大模型应用、智能体和行业 AI 平台的核心模块设计与研发,包括任务规划、任务拆解、工作流编排、工具调用、记忆、反思和结果验证。
2. 建设模型接入与调用能力,支持同步和流式输出、模型路由、上下文管理、失败重试、降级、限流、超时控制及调用链路追踪。
3. 负责 RAG 相关能力建设,包括文档解析、切分、Embedding、向量检索、Rerank、证据引用和知识库更新。
使用 Python、Go 等技术栈,建设高可用服务、异步任务、消息队列、数据库及模型网关,保障系统稳定性和可维护性。
4. 协同算法团队完成 MiniCPM 及其他模型的服务化封装、性能优化与领域优化,参与 vLLM、SGLang、llama.cpp 或国产芯片推理栈的部署适配。
5. 参与 Docker、Kubernetes、CI/CD、监控、日志、告警和私有化离线安装能力建设,支持客户现场问题定位,并将真实业务需求沉淀为可复用的系统能力。
任职要求
1. 本科及以上学历,计算机、软件工程、人工智能等相关专业优先。
2. 具备扎实的 Python 或 Go 开发能力,熟悉服务端开发、API 设计、数据库和常用中间件。
3. 理解大模型、RAG、Agent 的基本工作方式,至少在其中一个方向有实际项目经验。
4. 熟悉 FastAPI、PostgreSQL/MySQL、Redis、消息队列、Milvus 或其他向量数据库中的部分技术栈。
5. 具备良好的工程习惯,重视自动化测试、日志追踪、故障排查和版本管理,愿意处理从开发、联调到生产运行的完整问题。
加分项
1. 有智能体平台、数字员工、MCP、工具调用、多 Agent 协作或长任务执行经验。
2. 有 vLLM、SGLang、TensorRT-LLM、llama.cpp 或其他国产芯片适配经验。
3. 有端侧、边缘侧、离线环境、信创环境或一体机交付经验。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。