资深HPC&云原生基础架构工程师(芯片研发) 30-50k·15薪
深圳 5-10年 统招本科 招1人 7月20日更新
收藏
avator avator
蒋女士 一周前在线 已认证
猎头顾问 · 北京科锐国际人力资源股份有限公司
简历处理快
聊一聊
职位介绍
岗位职责: 1.负责芯片研发HPC平台的规划、建设、升级、运维和性能优化。 2.负责HPC集群管理及调度策略优化,包括队列、资源、Fairshare、抢占、回填调度、项目配额和高可用管理。 3.分析芯片研发计算环境中的性能瓶颈,覆盖计算、内存、存储、网络、调度和EDA License等维度。 4.根据芯片研发项目和Tape-out周期进行容量规划、资源预测和架构扩展。 5.负责传统基础架构及研发服务向Kubernetes云原生架构迁移。 6.负责生产级Kubernetes集群的部署、升级、运维、监控和故障处理。 7.建立公司级资源监控平台,对公司各集群持续优化和效率提升。 8.与芯片研发、EDA、存储、网络及供应商协作,推动基础架构问题闭环和架构持续演进。 任职要求 1.具备8年以上的芯片研发、EDA或半导体行业HPC平台建设和运维经验。 2.精通至少一种主流的HPC调度器,能够独立完成集群部署、升级、调度优化、性能分析和故障处理。 3.具备生产级Kubernetes运维及传统架构向云原生架构迁移经验。 4.熟悉Linux系统、NFS/并行文件系统、高性能网络及性能调优。 5.能够从计算、存储、网络、调度和License等维度综合分析HPC性能瓶颈。 6.熟悉Python、Shell、Ansible 等自动化技术。 7.具备大型集群容量规划、架构设计和跨团队项目推动能力。 8.熟悉主流EDA工具、FlexLM、GPFS、Lustre、Slurm或 GPU 集群者优先。 三、加分项 1.具备 Cadence, Synopsys, Siemens EDA等工具运行环境支持经验。 2.熟悉FlexNet/FlexLM、RLM等许可证管理系统。 3.熟悉 IBM LSF License Scheduler。 4.熟悉 Slurm、 PBS Pro, OpenPBS, SGE等其他HPC调度平台。 5.具备 GPFS/Spectrum Scale,Lustre,BeeGFS、Ceph、JuiceFS等文件系统经验。 6.具备GPU 集群、CUDA、NVIDIA GPU Operator 或AI/HPC 融合平台经验。 7.具备 Kubernetes Operator、Helm、Argo CD、GitOps 或 Jenkins CI/CD经验。 8.具备 Prometheus、Grafana、ELK、Datadog等监控平台建设经验。 9.具备大规模集群容量规划、成本分析或资源计费系统建设经验。 10.具备英文技术文档阅读、原厂支持沟通及跨团队项目推动能力。
其他信息
语言要求:不限
行业要求:电子/半导体/集成电路

猎聘温馨提示:

1. 如您发现平台内招聘方存在以下违规行为的,请立即举报
  • · 扣押您的身份证件或者其他证件;
  • · 要求您提供担保人、担保金或者以其他名义向您收取财物( 如培训费、体检费、资料费、置装费、押金等);
  • · 强迫您入股或者向您集资;
  • · 以招聘名义牟取不正当利益;
  • · 发布虚假招聘广告信息;
  • · 工作时长违反劳动法规定;
  • · 存在其他损害您的合法权益的行为。
2. 如您应聘的岗位属于涉外劳务合作/海外岗位的,请务必核实招聘方对外劳务合作资质取得情况,同时注意自身资金安全,防范招聘欺诈。
3. 本平台招聘方不向求职者提供任何收费服务。
查看全部
更新时间:2026-08-04