多模态AI模型算法工程师(视觉 + 文本 + 传感器)
岗位信息
| 招聘单位 | 镁伽科技 |
|---|---|
| 工作地点 | 苏州市、上海市、北京市 |
| 官方更新时间 | 2026-05-13T18:13:35 |
职位描述
1. 研发视觉 - 文本 - 传感器数据融合的多模态大模型,服务于镁伽鲲鹏实验室的显微图像分析、半导体缺陷检测、新能源设备状态识别等核心场景。
2. 构建多模态训练数据:实验图像、设备照片、传感器时序数据、操作手册文本,完成对齐与标注,支撑高质量模型训练。
3. 优化多模态模型架构(如 CLIP、Flux、Qwen-VL),提升小样本、低质量数据下的行业场景性能,降低标注成本。
4. 落地多模态应用:智能实验图像解读、半导体晶圆缺陷分类、设备异常视觉诊断、工艺文档智能理解,直接赋能镁伽自动化产品线。
5. 与视觉算法团队协作,融合 3D 视觉、亚像素图像处理技术,提升工业级识别精度,满足半导体、生物医药等领域的高标准要求。
任职要求
1. 硕士及以上学历,计算机 / AI / 计算机视觉 / 多模态相关专业,2 年以上多模态大模型研发经验。
2. 精通 PyTorch,熟悉 CLIP、Flux、LLaVA、Qwen-VL 等多模态模型,有训练 / 微调经验。
3. 掌握计算机视觉基础(CNN、目标检测、分割、OCR),有图像 / 视频分析项目经验。
4. 有工业视觉(半导体、新能源)或生物医学图像(细胞、显微)分析经验,熟悉镁伽相关设备数据者优先。
5. 能独立设计多模态实验、分析结果,推动模型迭代。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。