到岗时间:不限
婚况要求:不限
岗位职责:
1. Agent 系统研发:设计并实现复杂 Agent 架构,包括多 Agent 协作、任务规划、工具调用链路(Tool Use / Function Calling)、记忆机制与自主决策能力,构建可落地的智能体系统。
2. RAG 与知识增强:深度研发检索增强生成系统,涵盖向量检索、混合检索、Rerank、知识图谱融合等模块,持续提升模型在复杂知识问答场景下的准确性与可靠性。
3. 模型微调与对齐:主导大模型指令微调(SFT)、偏好对齐(RLHF / DPO / PPO)及参数高效微调(LoRA / QLoRA),针对业务场景定制高性能垂域模型。
4. 能力模块化研发:拆解并构建模型核心能力模块,包括长文本理解、推理链增强(CoT / ToT)、代码生成、结构化输出等,形成可插拔、可复用的能力组件体系。
5. 多模态融合:参与图文、语音、视频等多模态模型研发,探索跨模态理解与生成能力,推进多模态 Agent 在真实场景中的落地应用。
6. 评测框架(Harness)建设:设计并维护模型评测体系,基于 LM-Evaluation-Harness 等框架构建自动化评估流水线,覆盖能力基准、业务指标与对齐安全多维度评测。
7. 前沿技术研究与落地:持续跟踪 NeurIPS / ICLR / ACL 等顶会动态,重点关注 harness工程、skills研发、A2A协议等,快速完成 PoC 验证并推进工程转化。
8. Vibe Coding 与 AI 编程增强:探索 LLM 驱动的智能编程范式,研究代码理解、自动补全、Bug 修复、代码审查等场景,构建 AI Native 的开发辅助能力。
任职要求:
1. 硕士及以上学历,计算机科学与技术、人工智能、数学、统计学等相关专业。
2. 扎实的深度学习与 NLP 基础,深入理解 Transformer 架构,熟悉主流开源 LLM(LLaMA、Qwen、DeepSeek、Mistral 等)。
3. 熟练掌握 PyTorch,具备模型训练、微调或推理优化实战经验;有 DeepSpeed / Megatron 分布式训练经验者优先。
4. 对前沿 AI 技术保持高度敏感,有顶会论文、开源项目或技术博客贡献者优先。
5. 具备良好的工程素养,代码规范,能独立推进从研究到落地的完整链路。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。