电话:0351-7221990
关闭
深度学习框架研发专家 35000-50000 收藏 申请职位 主管直聊
您当前的位置: 首页 > 职位列表 > 职位详情

深度学习框架研发专家

35000-50000
上海-上海 | 3年以上经验 | 硕士学历
2026-06-10 更新 被浏览:
企业未开启查看联系方式,请直接投递简历 投递简历
职位描述
到岗时间:不限 婚况要求:不限 框架适配与优化:PyTorch、vLLM 等主流框架在自研 AI 芯片的适配开发,实现 Aten 算子层到芯片指令集的高效映射及兼容。 2. 框架特性迭代:跟踪开源框架技术演进,从上游合并新功能代码,持续优化框架在芯片上的内存管理、任务调度与计算效率,解决跨层适配瓶颈。 生态协同支撑:联动算子与模型团队,设计框架算子接口规范,提供框架层性能分析工具与技术支持,保障大模型训推流程的端到端顺畅性。 1. 学历背景: 双一流 /985 高校硕士及以上学历,计算机、软件工程相关专业,3 年以上深度学习框架开发经验。 2. 技术能力: 1) 精通 C /Python,深入理解至少 1 种主流框架(PyTorch 优先)的底层架构,熟悉算子注册、自动微分等核心模块实现逻辑; 2) 具备 Linux 系统开发与调试能力,熟练使用 GDB、Perf 等工具,能定位并解决框架级性能问题; 3) 了解 AI 芯片硬件特性(如 NPU 计算单元、存储层次),有国产芯片框架适配经验者优先。 加分项:PyTorch 官方生态贡献者、有 vLLM/SGLang 框架二次开发经验者优先。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。
该公司的其他职位
会员等级
  • 互联网服务
  • 10-50人
  • 500万
负责裸金属服务器全生命周期管理平台的设计、开发与迭代,覆盖服务器部署、配置、监控、运维、销毁等核心流程,支撑智算基础设施高效稳定运行; 设计并实现高可用、高性能平台核心模块,包括资源调度、带外管理、镜像管理、PXE 部署、RAID 配置、任务编排等; 负责平台 API 设计与开发,支撑前端交互、第三方系统集成,推动运维操作平台化、自动化; 面向大规模裸金属及 GPU 集群场景,解决批量交付、并发管控、硬件兼容性、异常恢复等关键问题,保障平台在复杂场景下的稳定性与交付效率。 参与平台架构设计、技术选型与方案评审,沉淀裸金属管理核心技术能力,实现技术对内沉淀、对外赋能。 与运维、网络、IDC 等相关团队协作,将线下操作流程抽象为平台能力,推动设备运维自动化闭环。 任职要求: 本科及以上学历,计算机、电子信息、软件工程等相关专业,3 年及以上 Golang 后台开发经验; 熟练掌握 Golang 语言特性,具备扎实的并发编程、性能优化能力;有高并发、高可用系统设计经验,具备 RESTful API 设计、服务治理、可观测性等工程化能力。 深入理解裸金属服务器管理相关核心技术,包括但不限于 BMC 带外管理、PXE 网络装机、镜像制作与分发、RAID / LVM 配置、服务器健康检测与故障定位 等。 熟悉 Linux 系统及常见问题排查,具备基础的网络知识,理解 TCP/IP、HTTP、DNS、DHCP、TFTP 等常见协议与服务;了解 Nginx、Ansible 等常见基础组件和自动化工具。 熟悉 MySQL、Redis 等常用存储组件,具备数据库设计、索引优化和高并发场景下的数据处理经验。 具备良好的问题分析与系统设计能力,能够在复杂基础设施场景下推进问题定位、方案落地和跨团队协作,对云基础设施或智算基础设施有较强兴趣和理解。 任职要求 本科及以上学历,计算机、电子信息、软件工程等相关专业,3 年及以上 Golang 后台开发经验; 熟练掌握 Golang 语言特性,具备扎实的并发编程、性能优化能力;有高并发、高可用系统设计经验,具备 RESTful API 设计、服务治理、可观测性等工程化能力。 深入理解裸金属服务器管理相关核心技术,包括但不限于 BMC 带外管理、PXE 网络装机、镜像制作与分发、RAID / LVM 配置、服务器健康检测与故障定位 等。 熟悉 Linux 系统及常见问题排查,具备基础的网络知识,理解 TCP/IP、HTTP、DNS、DHCP、TFTP 等常见协议与服务;了解 Nginx、Ansible 等常见基础组件和自动化工具。 熟悉 MySQL、Redis 等常用存储组件,具备数据库设计、索引优化和高并发场景下的数据处理经验。 具备良好的问题分析与系统设计能力,能够在复杂基础设施场景下推进问题定位、方案落地和跨团队协作,对云基础设施或智算基础设施有较强兴趣和理解。 加分项 有 IaaS 管理平台、裸金属管理平台、装机平台、资源调度平台 等相关研发经验。 有 OpenStack / Ironic、CloudStack、MAAS、Tinkerbell 等基础设施平台或裸金属管理体系相关经验。 熟悉面向 GPU 服务器 / 训练集群 的裸金属管理场景,包括批量装机、节点健康检查、拓扑识别、多机互联压测,以及 RDMA / InfiniBand / NVlink 等基础能力验证。 有大规模服务器集群、智算集群或数据中心基础设施相关研发经验者优先。
分享到朋友圈
分享至朋友圈
↑微信扫上方二维码↑
生成职位海报
分享到朋友圈
竞争力分析
综合竞争力评估
问公司
对职位有疑问?快来问问吧
手机扫一扫
随时随地找工作
简历投递成功
您可以在 个人中心 - 简历管理 - 我的简历 中查看您创建的简历
您可能感兴趣的职位:
关注微信公众号
申请结果早知道
联系时请说明是在英联优聘-找工作,学技能,拓人脉,上英联优聘!上看到的
正在获取二维码...
请使用微信扫一扫
客服服务热线
0351-7221990
周一到周日 9:00-19:00
微信公众号
手机浏览

温馨提示:根据国家有关规定,用人单位不得向求职者收取抵押金及任何费用,请求职者加强自我保护意识!
Copyright © 2016-2022 All Rights Reserved 晋ICP备2021018695号

地址:中国 · 山西 · 太原 EMAIL:1020552200@qq.com

人力资源证: 1401002200248

用微信扫一扫