到岗时间:不限
婚况要求:不限
岗位职责:
1、负责构建与维护强化学习(RL)与模仿学习(IL)训练平台,支撑人形机器人行走、操作、全身控制等算法的训练与迭代;
2、设计并实现从仿真到实机的数据闭环,包括数据采集、存储、清洗、标注、版本管理与回放,确保数据可复用、可追溯;
3、支持多来源数据的统一管理与处理,包括仿真数据、实机运行数据、示教数据与回放数据;
4、构建并维护训练与评测用 Benchmark 体系,定义关键指标(稳定性、成功率、能耗、鲁棒性等),支撑算法横向对比与持续优化;
5、开发和维护数据回放与可视化工具,支持问题复现、算法调试与效果分析;
6、与算法、仿真、系统软件团队协作,将学习方法稳定嵌入整体研发流程,而非孤立实验;
7、优化训练效率与资源使用(计算、存储、训练调度),提升整体研发效率;
8、编写并维护学习平台与数据相关的技术文档、接口说明与使用规范。
任职要求:
1、计算机、机器人、人工智能或相关专业背景;
2、熟悉强化学习或模仿学习的基本流程,理解训练、评估与迭代机制;
3、具备良好的工程能力,能够搭建和维护训练平台或工具链;
4、理解数据在学习系统中的核心作用,具备数据工程基本能力;
5、能与算法工程师高效协作,将学习方法真正落地到系统中。
6、有机器人、控制或仿真环境中的 RL / IL 实际经验;
7、有仿真–实机(Sim2Real)数据闭环经验;
8、有大规模数据处理、分布式训练或训练调度经验;
9、有 Benchmark、评测体系或实验管理系统设计经验;
10、熟悉常见学习框架或工具链(不限具体框架,重在方法);
11、有完整 从数据到模型再到实机验证 的工程闭环经验。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。