大模型算法-2026届(J42755)
岗位信息
| 招聘单位 | 可庭科技 |
|---|---|
| 工作地点 | 苏州市、北京市、深圳市、上海市 |
| 官方更新时间 | 2025-08-29T16:02:51 |
职位描述
负责大语言模型(LLM)的预训练、微调、推理优化及应用落地,推动模型在自然语言处理、多模态等领域的创新。
开展大模型能力增强研究,包括但不限于指令微调、人类反馈强化学习(RLHF)、上下文学习、智能体推理等方向。
探索大模型的高效优化技术,如模型压缩、量化、蒸馏、加速推理等,提升计算效率与落地可行性。
构建和优化大规模训练数据集,设计数据清洗、增强及合成方案,提升模型泛化与对齐能力。
任职要求
计算机、人工智能、数学等相关专业硕士或博士学历。
熟练掌握Python和深度学习框架(如PyTorch、TensorFlow、JAX等),具备分布式训练和性能调优经验。
深入理解Transformer、注意力机制等大模型核心原理,熟悉经典模型(如GPT、LLaMA、CLIP等)。
具备大模型预训练/微调/RLHF全流程经验,或在高水平会议(ACL、ICML、NeurIPS等)发表论文者优先。
具备优秀的问题解决能力和工程实现能力,对大模型技术有强烈热情和探索精神。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。