到岗时间:不限
婚况要求:不限
岗位职责
1.根据公司实际业务情况,选择适合的开源模型并进行私有化部署和维护;
2.构建高效、可扩展的AI大模型架构,包括但不限于Transformer架构的变体等,以满足不同业务场景下的需求。
3.负责模型参数的调整和优化,提高模型的性能和准确性。
4.研究和应用模型压缩、量化、蒸馏等技术,降低模型的存储和计算成本,提高模型的推理速度和效率。
5.根据业务需求,设计和开发基于AI大模型的应用程序和解决方案,将AI模型与现有的系统和平台进行集成,实现系统的功能扩展和优化,并负责应用程序的具体部署和维护。
6.收集、梳理大规模数据,进行数据清洗和预处理,确保数据的质量和一致性,同时对数据进行标注和分类,为模型训练提供高质量的标注数据。运用数据分析和挖掘技术,从数据中提取有价值的信息和特征,为模型训练和优化提供支持。
任职要求
1.计算机科学、信息技术、人工智能、数学、统计学等相关专业硕士及以上学历。
2.熟练掌握Python、Java、C 等编程语言,具备良好的数据结构和算法基础。
3.熟悉TensorFlow、PyTorch等深度学习框架,能够进行模型的训练和优化。
4.熟悉掌握多模态技术和框架结构,了解其原理和应用场景。
5.对主流的Deepseek、Kimi、豆包、通义千问、智谱等大模型有深入研究和应用,对模型训练和微调有足够经验。
6.了解和熟悉机器学习算法和深度学习模型;
7.掌握数据挖掘、数据清洗、数据预处理等技术,能够熟练使用SQL/Hive/Spark相关工具和算法对大规模数据进行处理和分析。
8.熟悉NLP、RAG、CV、多模态和智能体等其中任一或者多个,并且有落地经验;
9.具有3年以上AI大模型研发和使用经验,有参与过制造业相关大模型项目或相关经验者优先。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。