语音算法工程师(语音识别) 40-70k
杭州 1-3年 博士 招1人 7月30日更新
收藏
avator
傅女士 1天前在线 已认证
项目主管 · 杭州林罗企业管理咨询有限公司
简历处理快 回复速度快
聊一聊
职位介绍
岗位职责: 负责语音理解方向的小模型及多模态大模型研发与落地,覆盖ASR、说话人分离、声纹识别、语音理解等核心场景; 负责端到端语音识别、流式/非流式识别、热词增强、领域自适应、标点恢复、逆文本正则化、时间戳对齐等能力建设; 负责说话人识别、验证、向量建模、聚类、分离及重叠语音检测等算法研发; 负责语音数据体系建设,包括音频清洗、VAD、切分、标注、数据增强、质量评估与数据闭环; 负责语音模型SFT、指令微调、偏好对齐、强化学习在语音问答/Agent场景中的设计与迭代; 负责语音推理服务与Infra建设,包括流式推理、低延迟ASR、GPU资源优化、量化、服务监控及评测平台; 跟踪ASR、Audio LLM、说话人识别、语音多模态等前沿技术并推动业务落地。 岗位要求: 计算机、人工智能、信号处理、语音识别、数学等相关专业; 扎实掌握机器学习、深度学习基础,对Transformer、Conformer、CTC、AED、Transducer等模型结构有深入理解; 熟悉ASR技术体系,具备语音识别模型训练、微调、评测、部署及线上优化全链路经验; 熟悉说话人识别/声纹识别技术,包括speaker embedding、x-vector、ECAPA-TDNN、余弦相似度、PLDA、聚类、阈值校准等; 熟悉语音数据处理全流程,有音频清洗、切分、标注、增强、训练集构建经验; 熟悉WER、CER、DER、EER、MinDCF等评测指标,能结合业务场景设计评测方案; 具备从0到1的算法项目落地经验,能独立完成方案设计、模型训练、服务部署与持续优化。 加分项: 有会议转写、电话质检、客服语音分析、实时字幕、语音助手、语音Agent等业务落地经验; 有FunASR、Paraformer、Whisper、SenseVoice、WeNet、ESPnet、Kaldi、NVIDIA NeMo等框架/模型使用经验; 有低延迟流式ASR、端侧语音识别、语音大模型部署优化经验; 有Audio LLM、Speech LLM、语音多模态Agent完整落地经验。
其他信息
语言要求:普通话
行业要求:互联网,计算机软件

猎聘温馨提示:

1. 如您发现平台内招聘方存在以下违规行为的,请立即举报
  • · 扣押您的身份证件或者其他证件;
  • · 要求您提供担保人、担保金或者以其他名义向您收取财物( 如培训费、体检费、资料费、置装费、押金等);
  • · 强迫您入股或者向您集资;
  • · 以招聘名义牟取不正当利益;
  • · 发布虚假招聘广告信息;
  • · 工作时长违反劳动法规定;
  • · 存在其他损害您的合法权益的行为。
2. 如您应聘的岗位属于涉外劳务合作/海外岗位的,请务必核实招聘方对外劳务合作资质取得情况,同时注意自身资金安全,防范招聘欺诈。
3. 本平台招聘方不向求职者提供任何收费服务。
查看全部
更新时间:2026-08-15