电话:0351-7221990
关闭
端侧AI部署工程师 25000-40000 收藏 申请职位 主管直聊
您当前的位置: 首页 > 职位列表 > 职位详情

端侧AI部署工程师

25000-40000
江苏-淮安 | 3年以上经验 | 本科学历
2026-06-10 更新 被浏览:
企业未开启查看联系方式,请直接投递简历 投递简历
职位描述
到岗时间:不限 婚况要求:不限 工作职责: 1、负责公司智能模组产品上AI模型的端侧集成与部署,包括但不限于语音转文字、图像识别、VLM、LLM中的一种或几种; 2、针对不同算力平台,完成模型的转换、量化、推理验证,确保模型在有限内存和算力下稳定运行; 3、优化模型推理性能(延迟、吞吐、功耗),结合业务场景进行压缩加速(INT8/INT4量化、算子替换、推理框架选型); 4、与算法团队配合,明确模型裁剪或输出格式要求;与嵌入式软件团队协作,完成模型在模组上的接口封装和SDK交付; 5、跟进主流推理框架(如NCNN、MNN、TensorFlow Lite、llama.cpp等)及硬件NPU/GPU加速方案,持续提升模组产品的AI能力。 基本要求: 1、熟悉至少一种AI模型的端侧部署全流程, 2、掌握常用的模型量化与转换工具(如ONNX、TensorRT、TensorFlow Lite Converter、llama.cpp量化脚本等); 3、熟练使用C/C 和Python,具备交叉编译、内存调试能力,能在Linux/Android环境下工作; 加分项: 有在智能模组、边缘计算设备、手机上实现端侧AI功能并量产落地的经验; 该岗位工作地点:为本公司在深圳设立的研发中心,劳动合同签订深圳子公司的。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。
该公司的其他职位
会员等级
  • 合资企业
  • 10-50人
  • 500万
工作职责: 1、负责公司智能模组产品上AI模型的端侧集成与部署,包括但不限于语音转文字、图像识别、VLM、LLM中的一种或几种; 2、针对不同算力平台,完成模型的转换、量化、推理验证,确保模型在有限内存和算力下稳定运行; 3、优化模型推理性能(延迟、吞吐、功耗),结合业务场景进行压缩加速(INT8/INT4量化、算子替换、推理框架选型); 4、与算法团队配合,明确模型裁剪或输出格式要求;与嵌入式软件团队协作,完成模型在模组上的接口封装和SDK交付; 5、跟进主流推理框架(如NCNN、MNN、TensorFlow Lite、llama.cpp等)及硬件NPU/GPU加速方案,持续提升模组产品的AI能力。 基本要求: 1、熟悉至少一种AI模型的端侧部署全流程, 2、掌握常用的模型量化与转换工具(如ONNX、TensorRT、TensorFlow Lite Converter、llama.cpp量化脚本等); 3、熟练使用C/C 和Python,具备交叉编译、内存调试能力,能在Linux/Android环境下工作; 加分项: 有在智能模组、边缘计算设备、手机上实现端侧AI功能并量产落地的经验; 该岗位工作地点:为本公司在深圳设立的研发中心,劳动合同签订深圳子公司的。
分享到朋友圈
分享至朋友圈
↑微信扫上方二维码↑
生成职位海报
分享到朋友圈
竞争力分析
综合竞争力评估
问公司
对职位有疑问?快来问问吧
手机扫一扫
随时随地找工作
简历投递成功
您可以在 个人中心 - 简历管理 - 我的简历 中查看您创建的简历
您可能感兴趣的职位:
关注微信公众号
申请结果早知道
联系时请说明是在英联优聘-找工作,学技能,拓人脉,上英联优聘!上看到的
正在获取二维码...
请使用微信扫一扫
客服服务热线
0351-7221990
周一到周日 9:00-19:00
微信公众号
手机浏览

温馨提示:根据国家有关规定,用人单位不得向求职者收取抵押金及任何费用,请求职者加强自我保护意识!
Copyright © 2016-2022 All Rights Reserved 晋ICP备2021018695号

地址:中国 · 山西 · 太原 EMAIL:1020552200@qq.com

人力资源证: 1401002200248

用微信扫一扫