到岗时间:不限
婚况要求:不限
工作职责:
1、负责公司智能模组产品上AI模型的端侧集成与部署,包括但不限于语音转文字、图像识别、VLM、LLM中的一种或几种;
2、针对不同算力平台,完成模型的转换、量化、推理验证,确保模型在有限内存和算力下稳定运行;
3、优化模型推理性能(延迟、吞吐、功耗),结合业务场景进行压缩加速(INT8/INT4量化、算子替换、推理框架选型);
4、与算法团队配合,明确模型裁剪或输出格式要求;与嵌入式软件团队协作,完成模型在模组上的接口封装和SDK交付;
5、跟进主流推理框架(如NCNN、MNN、TensorFlow Lite、llama.cpp等)及硬件NPU/GPU加速方案,持续提升模组产品的AI能力。
基本要求:
1、熟悉至少一种AI模型的端侧部署全流程,
2、掌握常用的模型量化与转换工具(如ONNX、TensorRT、TensorFlow Lite Converter、llama.cpp量化脚本等);
3、熟练使用C/C 和Python,具备交叉编译、内存调试能力,能在Linux/Android环境下工作;
加分项:
有在智能模组、边缘计算设备、手机上实现端侧AI功能并量产落地的经验;
该岗位工作地点:为本公司在深圳设立的研发中心,劳动合同签订深圳子公司的。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。