电话:0351-7221990
关闭
强化学习算法工程师 15000-22000 收藏 申请职位 主管直聊
您当前的位置: 首页 > 职位列表 > 职位详情

强化学习算法工程师

15000-22000
四川-成都 | 2年以上经验 | 本科学历
2026-06-10 更新 被浏览:
企业未开启查看联系方式,请直接投递简历 投递简历
职位描述
到岗时间:不限 婚况要求:不限 岗位职责: 1.负责灵巧手运动控制算法的前沿技术调研、方案设计与核心算法攻关; 2.负责深度强化学习算法的全周期开发,包括状态空间设计、奖励函数构建、策略训练及超参数调优; 3.搭建并维护仿真训练平台,完成算法在虚拟环境中的充分验证与迭代优化; 4.推动 Sim2Real 技术落地,完成模型在真机上的部署、调试及性能评估,解决物理世界中的泛化与鲁棒性问题; 5.与团队高效协作,优化算法训练 pipeline,提升模型训练效率与部署稳定性; 6.持续跟踪强化学习、模仿学习及具身智能领域最新进展,推动技术成果在产品中的转化与应用。 任职要求: 1.本科及以上学历,计算机、自动化、人工智能等相关专业,2年以上工作经验; 2.熟悉pytorch,TensorFlow,linux; 3.精通PPO、SAC、DDPG等主流算法,具备奖励函数设计能力; 4.熟悉仿真软件,有sim2sim,Sim2Real 相关落地经验优先; 5.了解运动学与动力学:熟悉正逆运动学、动力学建模、坐标变换,了解最优控制、MPC、WBC;熟悉力/位混合控制、阻抗/导纳控制、轨迹规划与运动插补; 6.了解 VLA多模态具身模型,具备视觉-语言-动作端到端训练与部署经验者优先; 7.工作严谨负责,沟通协作能力强,配合团队落地算法。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。
该公司的其他职位
    该企业暂无其他职位!
会员等级
  • 合资企业
  • 500-1000人
  • 500万
岗位职责: 1.负责灵巧手运动控制算法的前沿技术调研、方案设计与核心算法攻关; 2.负责深度强化学习算法的全周期开发,包括状态空间设计、奖励函数构建、策略训练及超参数调优; 3.搭建并维护仿真训练平台,完成算法在虚拟环境中的充分验证与迭代优化; 4.推动 Sim2Real 技术落地,完成模型在真机上的部署、调试及性能评估,解决物理世界中的泛化与鲁棒性问题; 5.与团队高效协作,优化算法训练 pipeline,提升模型训练效率与部署稳定性; 6.持续跟踪强化学习、模仿学习及具身智能领域最新进展,推动技术成果在产品中的转化与应用。 任职要求: 1.本科及以上学历,计算机、自动化、人工智能等相关专业,2年以上工作经验; 2.熟悉pytorch,TensorFlow,linux; 3.精通PPO、SAC、DDPG等主流算法,具备奖励函数设计能力; 4.熟悉仿真软件,有sim2sim,Sim2Real 相关落地经验优先; 5.了解运动学与动力学:熟悉正逆运动学、动力学建模、坐标变换,了解最优控制、MPC、WBC;熟悉力/位混合控制、阻抗/导纳控制、轨迹规划与运动插补; 6.了解 VLA多模态具身模型,具备视觉-语言-动作端到端训练与部署经验者优先; 7.工作严谨负责,沟通协作能力强,配合团队落地算法。
分享到朋友圈
分享至朋友圈
↑微信扫上方二维码↑
生成职位海报
分享到朋友圈
竞争力分析
综合竞争力评估
问公司
对职位有疑问?快来问问吧
手机扫一扫
随时随地找工作
简历投递成功
您可以在 个人中心 - 简历管理 - 我的简历 中查看您创建的简历
您可能感兴趣的职位:
关注微信公众号
申请结果早知道
联系时请说明是在英联优聘-找工作,学技能,拓人脉,上英联优聘!上看到的
正在获取二维码...
请使用微信扫一扫
客服服务热线
0351-7221990
周一到周日 9:00-19:00
微信公众号
手机浏览

温馨提示:根据国家有关规定,用人单位不得向求职者收取抵押金及任何费用,请求职者加强自我保护意识!
Copyright © 2016-2022 All Rights Reserved 晋ICP备2021018695号

地址:中国 · 山西 · 太原 EMAIL:1020552200@qq.com

人力资源证: 1401002200248

用微信扫一扫