AI存储专家(Storage AI Expert)(J14566) 30-50k·15薪
上海-浦东新区 10年以上 统招本科 招2人 8月5日更新
收藏
年终奖金 提供住宿 餐费补贴 加班补贴 带薪年假
avator avator
武女士 2天前在线 已认证
聊一聊
职位介绍
职责描述: 1. 跟踪主流大模型生态与开源模型发展,包括 Qwen、DeepSeek、Kimi、GLM、LLaMA、Gemma 等模型方向。 2. 研究大模型在 GPU 服务器/AI PC/边缘设备等平台上的部署,性能瓶颈分析与调优。 3. 基于 vLLM、SGLang、llama.cpp、Ollama、KTransformers、TensorRT-LLM 等推理框架,分析模型推理过程中的计算、显存、内存与存储需求。 4. 研究存储相关的关键AI领域技术,包括 KV Cache 的生成、访问、复用、卸载和回读机制,及分层卸载方案,PD分离架构对存储需求,长上下文推理,及超高性能SSD等领域,推导产品核心需求,并于上下游合作制定产品架构和技术路线图。 5. 主导面向AI新产品架构方向的技术预研、需求定义,并驱动产业上游。 6. 跟踪 GPU Direct Storage、GPU Initiated Storage、CXL、NVMe、OCP等AI领域相关技术与标准演进, 评估对产品影响并提出相关标准提案和建议。。 7.面向 AI 工作负载分析和针对性优化 任职要求: 1. 计算机、电子工程、软件工程、人工智能、存储系统等相关专业研究生及以上学历 2. 熟悉 Linux 系统,具备良好的问题定位、性能分析和实验验证能力。 3. 熟悉 Python、C/C++、Shell 中至少一种编程语言,能够进行实验脚本开发、数据分析和原型验证。 4. 理解 Transformer、大模型推理流程、Attention、KV Cache、Prefill / Decode、上下文窗口、Batching 等基本概念。 5. 熟悉至少一种主流大模型推理框架的部署和使用调优,如 vLLM、SGLang、llama.cpp、TensorRT-LLM、Ollama、KTransformers 等。 6. 有开源大模型部署、量化、推理优化、长上下文调优经验者优先。 7. 熟悉 SSD、NAND Flash、NVMe、PCIe、Linux IO Stack、文件系统、块设备等基础知识者优先。 8. 熟悉 fio、SPDK、io_uring、libaio、GDS等系统性能工具或技术者优先。 9. 理解 IOPS、带宽、延迟、QoS、写放大、GC、FTL、SLC Cache、QLC 等 SSD 关键概念者优先。 10. 具备较强的技术学习能力,熟练阅读英文论文、开源项目文档、标准规范和技术白皮书。 11. 具备良好的技术表达能力,能够将前沿技术问题转化为清晰的架构观点、实验方案和产品建议。 12. 熟练使用主流 AI技术和工具,对基础设施、存储系统、硬件架构演进有强烈兴趣,愿意探索新领域。
其他信息
行业要求:全部行业

公司简介

长江存储科技有限责任公司成立于2016年7月,总部位于“江城”武汉, 是一家专注于3D NAND闪存设计制造一体化的IDM集成电路企业,同时也提供完整的存储器解决方案。长江存储为全球合作伙伴供应3D NAND闪存晶圆及颗粒, 嵌入式存储芯片以及消费级、企业级固态硬盘等产品和解决方案,广泛应用于移动通信、消费数码、计算机、服务器及数据中心。
查看全部

猎聘温馨提示:

1. 如您发现平台内招聘方存在以下违规行为的,请立即举报
  • · 扣押您的身份证件或者其他证件;
  • · 要求您提供担保人、担保金或者以其他名义向您收取财物( 如培训费、体检费、资料费、置装费、押金等);
  • · 强迫您入股或者向您集资;
  • · 以招聘名义牟取不正当利益;
  • · 发布虚假招聘广告信息;
  • · 工作时长违反劳动法规定;
  • · 存在其他损害您的合法权益的行为。
2. 如您应聘的岗位属于涉外劳务合作/海外岗位的,请务必核实招聘方对外劳务合作资质取得情况,同时注意自身资金安全,防范招聘欺诈。
3. 本平台招聘方不向求职者提供任何收费服务。
查看全部

猜你喜欢

1 2 3 4
更新时间:2026-08-14