阿里-大模型高性能计算研发工程师 60-90k·16薪
北京 5-10年 硕士 招1人 8月15日更新
收藏
avator
周女士 4小时前在线 已认证
人力资源部经理 · 陕西凯德永驰企业管理咨询有限公司
简历处理快 回复速度快
聊一聊
职位介绍
职位描述 1. 负责模型训练场景中高性能计算Pipeline的实现,通过访存算子优化、算子融合、MoE/Attention算子定制,实现精细化显存管理、最大化计算/访存效率。 2. 负责结合大语言模型、多模态理解生成模型、Agentic RL等场景的模型训练需求进行算子设计,实现模型-Infra的Co-Design。 3. 负责世界模型、实时生成交互等场景的高性能低延迟算子设计和实现,满足模型加速上线的需求。 4. 使用专业的Profiling工具和手段,对大模型训练的端到端性能进行分析,精准定位Kernel执行、数据搬运、通信等环节的瓶颈,并提出体系化的优化方案。 5. 跟进业界SOTA的高性能计算工作,调研并实施异构硬件在超大规模训练场景的落地方案。 职位要求 1. 工程与算法基础:计算机相关专业背景,有极佳的工程实现能力,精通 C/C++ 与 Python;具备扎实的数据结构与算法功底,熟练掌握 GDB / Nsight 等调试与性能分析工具。 2. 异构计算与底层技术:熟悉异构计算体系结构,包括但不限于现代 GPU 并行架构;熟练掌握CUDA 编程、Triton 和 Cutlass 等硬件 DSL。 3. 算法工程协同设计:对 LLM、多模态等大模型结构及其核心算法流程有深入理解者优先。 4. 主流框架内核:精通 PyTorch / JAX / Megatron-LM 等业界主流大模型引擎的内核实现机制。精通 XLA / MLIR 等编译优化技术者优先。 5. 加分项:对钻研技术有热情,勤于动手,善于动脑,不惧困难。
其他信息
语言要求:不限
行业要求:科技金融,电子商务

猎聘温馨提示:

1. 如您发现平台内招聘方存在以下违规行为的,请立即举报
  • · 扣押您的身份证件或者其他证件;
  • · 要求您提供担保人、担保金或者以其他名义向您收取财物( 如培训费、体检费、资料费、置装费、押金等);
  • · 强迫您入股或者向您集资;
  • · 以招聘名义牟取不正当利益;
  • · 发布虚假招聘广告信息;
  • · 工作时长违反劳动法规定;
  • · 存在其他损害您的合法权益的行为。
2. 如您应聘的岗位属于涉外劳务合作/海外岗位的,请务必核实招聘方对外劳务合作资质取得情况,同时注意自身资金安全,防范招聘欺诈。
3. 本平台招聘方不向求职者提供任何收费服务。
查看全部
更新时间:2026-08-16