到岗时间:不限
婚况要求:不限
职位描述
岗位职责
1. 负责 Vision-Language-Action,VLA,模型相关的数据采集、数据清洗、标注规范设计、训练集构建与评测体系搭建。
2. 开展 VLA、多模态大模型、具身智能、视觉感知、机器人学习等方向的算法调研、模型训练、微调、部署与效果优化。
3. 负责基于 3D Gaussian Splatting、NeRF、多视角几何等技术的三维重建、渲染与场景表达算法开发。
4. 开发图像处理与计算机视觉算法,包括双目校正、深度估计、图像增强、畸变校正、去噪、超分、颜色一致性、实时渲染优化等。
5. 参与双目近眼显示系统设计与优化,结合光学设计、显示成像、算法补偿、视觉舒适度与系统标定,提升显示质量和用户体验。
6. 搭建算法 Demo 和原型系统,完成从论文复现、算法验证、工程实现到实验室样机落地的完整闭环。
7. 与光学、硬件、软件、产品、测试等团队协作,定义系统指标、实验方案、评测流程和技术路线。
8. 跟踪国内外前沿技术进展,撰写技术报告、项目申报材料、专利、论文及阶段性成果文档。
技术要求
1. 熟悉深度学习与计算机视觉基础,具备扎实的线性代数、概率统计、优化方法、多视角几何和图像成像基础。
2. 熟练掌握 Python,熟悉 PyTorch、TensorFlow、JAX 等至少一种深度学习框架;具备良好的代码实现、调试和实验管理能力。
3. 熟悉 C/C 者优先;有 CUDA、OpenGL、Vulkan、Unity、Unreal、TensorRT、ONNX 等实时系统或部署经验者优先。
4. 具备 VLA、多模态模型、Transformer、Diffusion、模仿学习、强化学习、机器人数据采集或具身智能相关经验者优先。
5. 熟悉 3D Gaussian Splatting、NeRF、神经渲染、三维重建、相机标定、位姿估计、SLAM、点云/网格处理等方向之一或多个方向。
6. 熟悉双目视觉、深度估计、立体匹配、图像配准、畸变校正、图像增强、ISP 或计算摄影相关算法。
7. 对 AR/VR/MR、近眼显示、双目显示、光学成像、视觉感知、人眼舒适度、foveated rendering 或显示标定有理解者优先。
8. 具备较强的工程落地能力,能够将前沿论文、开源项目或研究想法转化为可运行、可评测、可展示的原型系统。
9. 具备良好的英文论文阅读能力、技术文档撰写能力和跨学科沟通能力。
10. 有高水平论文、专利、开源项目、竞赛获奖、机器人/AR/VR/三维视觉系统项目经验者优先。
学历要求
1. 硕士研究生及以上学历,计算机科学与技术、人工智能、电子信息、自动化、光学工程、仪器科学、机器人、计算机视觉、计算机图形学、机器学习等相关专业优先。
2. 博士学历或具有 VLA、3D 视觉、近眼显示、AR/VR/MR 系统研发经验者优先。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。