到岗时间:不限
婚况要求:不限
岗位职责
1. 负责AI应用产品的整体架构设计与实现,包括前端交互界面、后端服务及算法模块的整合开发。
2. 开发高可用、低延迟的AI API服务,处理大模型调用、Prompt编排、结果流式传输等逻辑。
3. 设计并实现用户友好的前端界面(如聊天交互、数据可视化看板等页面),与后端实现无缝数据对接。
4. 基于大模型构建RAG应用,包括Query改写、混合检索(向量 关键词)、Rerank优化、知识库构建与更新。
5. 设计高质量Prompt方案,实现Function Calling或Agent调用。
6. 负责AI应用的全链路测试,包括单元测试、集成测试、E2E测试,以及针对大模型输出效果的离线/在线评估。
7. 设计RAG系统评测指标(命中率、MRR、生成长度、事实一致性等),建立回归测试机制。
8. 搭建LLMOps基础设施:日志/监控/告警、模型效果追踪、容器化部署(Docker/K8s);优化系统性能(并发、延迟、成本),保障服务SLA与可用性。
9. 与产品、业务团队紧密协作,快速将需求转化为可落地的技术实现。
任职要求
1.本科及以上学历,计算机、软件工程等相关专业,2年以上全栈或前后端 算法复合型工程经验。
2.精通Python,有FastAPI/Flask等RESTful服务开发经验;熟悉RAG、LangChain/LlamaIndex、向量数据库(Milvus/FAISS等);具备Prompt工程、Function Calling、大模型API调用与成本控制实践。
3.掌握至少一种现代前端框架(React/Vue/Angular),能独立完成界面开发、状态管理、前后端联调;熟悉HTML/CSS/Typescript。
4.熟悉Python(pytest)和前端(Jest/Vitest)测试框架;了解LLM输出效果评估方法。
5.熟练使用Linux、Git、Docker、K8s;具备CI/CD(GitLab CI/GitHub Actions)配置能力;理解稳定性设计(重试、降级、限流)。
加分项
1.有AI产品(客服、搜索、代码助手等)从0到1落地经验。
2.熟悉流式传输(SSE/WebSocket)、Web Worker或性能优化。
3.贡献过开源项目或写过高质量技术博客。
4. 具备良好的自驱力与沟通能力,能在模糊需求下快速原型验证与迭代。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。