到岗时间:不限
婚况要求:不限
岗位职责:
1、负责多模态大模型 视觉算法融合的银行AI合规系统研发,基于多模态大模型(如 Qwen-VL)与视觉基础模型(如 CLIP),完成监控视频的行为理解、场景理解与语义级合规测评。
2、构建"大模型语义理解 小模型精准感知"双层算法架构,结合 YOLO 目标检测、SAM 图像分割、视频追踪、视频抽帧与片段合成等技术,支撑细粒度违规识别、证据链生成与可视化回溯。
3、基于多模态大模型 RAG 构建银行合规知识库,将规章制度入库实现视频内容与合规条款的智能匹配、自动判责、自动质检与异常事件智能归因。
4、融合视频大模型、语音大模型、人脸算法做多模态分析,解决传统 CV 无法识别的复杂、模糊、非标违规场景,支持实时视频流推理与离线复盘测评。
5、负责多模态大模型行业落地全流程:Prompt 工程、RAG、LoRA 微调、视觉指令微调、推理部署与效果迭代,持续提升识别准确率与召回率,输出标准化 AI 合规测评体系。
任职要求:
1、具备多模态大模型落地经验(应用开发 / 微调 / Prompt / RAG 任一方向有深度实战);熟悉 Qwen-VL、LLaVA 等主流多模态大模型架构,理解 CLIP、ViT 等视觉编码器与 LLM 的对齐机制。
2、掌握 YOLO、SAM 等主流检测分割模型,以及多目标视频追踪算法的训练、优化与部署。
3、掌握大模型应用开发:Prompt 工程、Few-shot、CoT、Agent 设计;具备 RAG 知识库搭建、向量检索与多模态 RAG 落地经验。
4、有大模型微调经验优先:LoRA / QLoRA 微调、视觉指令微调、模型量化与私有化部署经验。
5、熟悉视频理解相关技术优先:视频时序建模、视频多模态大模型、视频生成与合成。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。