到岗时间:不限
婚况要求:不限
岗位职责
负责云端多模态大模型(LLM / VLM)的训练、微调与评估;
负责大模型在云端的部署、推理优化与服务化(API化);
设计并实现云端大模型与本地小模型之间的通信与协同机制(如蒸馏、路由、分层推理等);
基于 AWS(如 EC2、S3、EKS、ECR 等)搭建与维护训练与推理基础设施;
负责模型性能优化,包括推理加速(TensorRT / vLLM / quantization 等);
参与多模态数据处理(图像、文本、语音等)与训练管道建设。
任职要求
计算机、人工智能或相关专业;
熟悉 PyTorch / Deep Learning 训练框架;
熟悉大模型训练或微调(LLM / Vision-Language Model);
熟悉模型部署与推理服务(FastAPI / Triton / vLLM 等);
熟悉 AWS 云平台(EC2、S3、EKS、IAM、ECR 等);
了解分布式训练或多机多卡(DDP / FSDP);
熟悉 Python,具备一定 C 或系统工程能力。
加分项
有多模态模型(如 CLIP、LLaVA、Gemini 类)经验;
有云端大规模训练或推理优化经验;
熟悉模型压缩(量化、蒸馏、剪枝);
有边缘端/本地小模型部署经验;
熟悉 AWS 生产级 MLOps 架构;
有 K8s / Docker / CI-CD 实践经验。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。