电话:0351-7221990
关闭
具身智能算法工程师(模型量化与部署方向) 25000-50000 收藏 申请职位 主管直聊
您当前的位置: 首页 > 职位列表 > 职位详情

具身智能算法工程师(模型量化与部署方向)

25000-50000
江苏-淮安 | 1年以上经验 | 本科学历
2026-06-10 更新 被浏览:
企业未开启查看联系方式,请直接投递简历 投递简历
职位描述
到岗时间:不限 婚况要求:不限 岗位职责 61具身智能模型优化:负责具身智能核心算法(VLA、大型视觉语言模型、语音模型、感知模型)在边缘端(如NVIDIA Jetson Orin)的部署与加速。主导模型从训练态到推理态的转化,解决 大模型上机 的显存与算力瓶颈。 61深度量化与压缩实战:针对不同架构模型制定差异化压缩策略。针对Transformer类(VLA/VLM)模型,负责FP8/INT4/INT8混合精度量化,优化KV Cache显存占用,解决量化后的精度对齐与长文本推理稳定性问题;针对CNN类(感知/识别)模型,实施通道剪枝与定点量化,确保在极低算力消耗下保持高识别率。 61高性能推理引擎开发:基于TensorRT、ONNX Runtime构建高性能推理引擎。利用Python接口进行模型转换与优化,解决复杂算子不支持问题,实现多模型(视觉 语音 动作)并发推理的流水线并行。 61工程化落地与LeRobot应用:利用LeRobot等框架快速验证算法可行性,并将其转化为高性能Python生产代码。设计低延迟、高吞吐的推理服务架构,确保多模态交互(ASR/TTS)的实时性与动作控制的平滑性。 61全链路性能调优:负责从传感器数据采集、预处理、模型推理到后处理的全链路性能剖析(Profiling),定位并消除系统瓶颈,确保端到端延迟满足实时控制要求。 任职要求 61学历背景:计算机、电子工程、自动化等相关专业,本科3年以上或硕士1年以上相关工作经验。 61量化专家级能力:精通模型量化技术,深入理解PTQ(训练后量化)与QAT(量化感知训练)原理。有Transformer(LLM/VLM)与CNN混合架构的量化实战经验,能独立解决量化掉点、算子不支持等棘手问题。熟悉SmoothQuant、AWQ、GPTQ等主流量化算法者优先。 61部署加速实战:精通TensorRT或ONNX Runtime,具备深厚的模型优化功底,能熟练使用各类量化工具链。熟悉模型在嵌入式GPU(Jetson系列)上的显存管理、带宽优化及功耗控制。 61工程化与框架:精通PyTorch模型导出ONNX及TensorRT的全流程,熟悉动态Shape处理。具备极强的Python工程能力,代码逻辑严密,熟悉多线程/多进程编程及异步IO,能编写高质量、可维护的生产级代码。了解LeRobot等开源框架,能快速理解其数据流与模型接口。 61加分项:有Qwen、Llama等大模型在端侧部署经验;熟悉ASR/TTS模型的流式推理优化;在GitHub上有高星量化库或推理框架开源项目。 核心关键词:模型量化 | TensorRT/ONNX加速 | VLA/VLM部署 | Python工程化 | LeRobot | 边缘计算
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。
该公司的其他职位
会员等级
  • 1000人以上
  • 500万
岗位职责: 1、负责新产品FCT测试治具设计工作评估; 2、负责各类型产品FCT测试治具的结构设计 3、分析解决生产中与FCT测试的相关问题及异常并提出相应对策。 岗位要求: 1、统招全日制大专以上学历; 2、三年以上电子行业FCT结构设计经验; 3、熟练操作办公软件AOTUCAD、(SolidWorks、 Creo、UG其中一个)
分享到朋友圈
分享至朋友圈
↑微信扫上方二维码↑
生成职位海报
分享到朋友圈
竞争力分析
综合竞争力评估
问公司
对职位有疑问?快来问问吧
手机扫一扫
随时随地找工作
简历投递成功
您可以在 个人中心 - 简历管理 - 我的简历 中查看您创建的简历
您可能感兴趣的职位:
关注微信公众号
申请结果早知道
联系时请说明是在英联优聘-找工作,学技能,拓人脉,上英联优聘!上看到的
正在获取二维码...
请使用微信扫一扫
客服服务热线
0351-7221990
周一到周日 9:00-19:00
微信公众号
手机浏览

温馨提示:根据国家有关规定,用人单位不得向求职者收取抵押金及任何费用,请求职者加强自我保护意识!
Copyright © 2016-2022 All Rights Reserved 晋ICP备2021018695号

地址:中国 · 山西 · 太原 EMAIL:1020552200@qq.com

人力资源证: 1401002200248

用微信扫一扫