多模态模型研究员(3D点云/图像/文本方向)(J10722)
岗位信息
| 招聘单位 | 柏楚电子 |
|---|---|
| 工作地点 | 上海市 |
| 官方更新时间 | 2026-05-15T16:25:17 |
职位描述
聚焦3D点云处理、图像感知、多模态融合方向,开展物理世界多模态感知大模型的前沿算法研究,突破SOTA技术瓶颈;
负责多模态大模型的预训练与后训练(SFT、RLHF),设计图像-点云-文本的跨模态特征对齐机制;
负责3D目标检测/分割等核心算法设计与实现,适配工业机器人场景;
利用自监督学习设计掩码预测等任务,提升模型在无标注数据上的特征提取能力;
完成算法从原型到产品的全链路开发,包括模型训练、量化、加速(TensorRT/ONNX),满足性能要求
任职要求
学历专业:硕士及以上学历;计算机视觉、人工智能、机器人等相关专业;
3D点云能力:精通PointNet系列、VoxelNet、CenterPoint等点云深度学习架构;熟悉Open3D、PCL、MMDetection3D;
图像感知能力:精通目标检测、分割、深度估计等2D视觉算法;熟悉Transformer、CNN、SAM等模型架构;
多模态与大模型:熟悉CLIP、BLIP、LLaVA等多模态模型架构;有大模型预训练或SFT实践经验;
编程与工程:精通Python/C++与PyTorch;有CUDA编程或TensorRT加速经验者优先;
加分项:在CVPR/ICCV/NeurIPS等顶会发表论文;熟悉NeRF/3DGS/VLA/世界模型;有具身智能或仿真环境经验;
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。