高级AI系统部署与加速工程师 (机器人方向) 25-55k·16薪
苏州-吴中区 3年以上 统招本科 招1人 6月22日更新
收藏
年终奖金 五险一金 节日礼物 优秀员工奖 定期体检 年底双薪 团队聚餐 休闲餐点 年度旅游 带薪年假
avator
徐女士 一周前在线 已认证
聊一聊
职位介绍
岗位职责 - 负责机器人相关 感知、LLM、多模态语音等AI模型 的工程化部署、加速优化与系统集成 设计、开发并维护 AI推理与感知模块软件框架,提升系统可扩展性与稳定性 - 负责深度学习模型在 NVIDIA GPU平台(CUDA / TensorRT) 上的部署、调优与功能集成 - 主导模型推理链路的 性能优化、显存优化、延迟优化及资源利用率评估 - 参与算法到工程落地全过程,包括: - 模型部署 - 插件开发 - 多模块联调 - 性能测试与持续迭代优化 - 参与 Transformer 类模型的端侧部署优化,包括 Attention、LayerNorm、MLP 等关键算子的加速与融合 - 负责构建和维护 机器人AI数据与问题分析工具链,提升研发与问题闭环效率,包括: - 数据录制工具开发(多传感器数据采集与同步) - 离线数据回灌系统开发 - 推理结果可视化与调试工具开发 - 负责GPU Profiling与系统级性能分析,定位并解决瓶颈问题 - 支持机器人整机系统联调,推动AI能力在真实场景中的稳定落地 任职要求 基本要求 - 本科及以上学历,电子、通信、计算机、自动化或相关专业 - 3年以上AI模型工程化部署或推理加速经验 - 扎实的 C++ / CUDA / Python 编程能力 - 熟练掌握: - 多线程、并发编程 - 常用数据结构与算法 - 设计模式与高性能代码架构设计 - 熟悉 Linux 开发环境,具备良好的调试与问题定位能力 - 能熟练使用 Nsight Systems / Nsight Compute / NvProf 等GPU分析工具 - 熟悉主流深度学习模型结构及相关部署:Transformer / CNN / RNN 等 - 具备良好的工程规范、文档编写能力和团队协作能力 工程能力要求 - 有 TensorRT部署、插件开发、Kernel优化 实战经验 - 熟悉 CUDA加速、显存管理、流并发、异步执行机制 - 具备 Transformer 关键算子部署与优化经验,如:Multi-Head Attention 加速 LayerNorm / RMSNorm 优化,并且能从算子级别理解模型性能瓶颈并推动融合或自定义实现 - 熟悉 Linux 下的协程、异步框架或高性能IO方案 - 能编写高效的自动化分析脚本与性能测试工具 - 具备完整的模型从训练 → 转换 → 部署 → 优化的工程理解 模型压缩与端侧适配能力(新增重点) - 具备 模型剪枝(结构化/非结构化)后的部署适配经验 - 具备 知识蒸馏模型在端侧部署与性能收益评估经验 - 熟悉 量化模型(FP16 / INT8)部署流程与精度验证方法 - 能与算法团队协作完成模型压缩方案在端侧的工程落地与性能验证 加分项(强相关优先) 有模型剪枝、量化、蒸馏等模型压缩经验 有模型训练或算法调优经验 有机器人或自动驾驶行业背景 有 非NVIDIA平台(如地平线、黑芝麻等)AI芯片部署优化经验 英文技术文档阅读与交流能力良好 熟练 Linux Troubleshooting: - Coredump 分析 - GPU异常排查 - 性能瓶颈定位
其他信息
语言要求:普通话
行业要求:具身智能与机器人,人工智能

公司简介

深庭纪位于苏州吴中,致力于使用前沿AI技术打造人类的机器伙伴。创始人王弢毕业于斯坦福大学人工智能专业,曾任小鹏自动驾驶感知和机器人AI大脑负责人。公司创立一年多来已完成数千万元融资,研发团队快速扩张中,期待您的加入
查看全部

猎聘温馨提示:

1. 如您发现平台内招聘方存在以下违规行为的,请立即举报
  • · 扣押您的身份证件或者其他证件;
  • · 要求您提供担保人、担保金或者以其他名义向您收取财物( 如培训费、体检费、资料费、置装费、押金等);
  • · 强迫您入股或者向您集资;
  • · 以招聘名义牟取不正当利益;
  • · 发布虚假招聘广告信息;
  • · 工作时长违反劳动法规定;
  • · 存在其他损害您的合法权益的行为。
2. 如您应聘的岗位属于涉外劳务合作/海外岗位的,请务必核实招聘方对外劳务合作资质取得情况,同时注意自身资金安全,防范招聘欺诈。
3. 本平台招聘方不向求职者提供任何收费服务。
查看全部
更新时间:2026-06-29