返回岗位列表

阶跃星辰

语音大模型测试工程师

地点:北京 薪资:薪资未公开 日期:2026-09-19

岗位摘要

负责语音大模型及实时语音交互系统的测试与质量保障,建立覆盖模型能力、功能、性能及稳定性的测试体系;负责语音大模型测试方案设计与执行,围绕ASR、TTS、实时交互、全双工等能力,构建自动化测试及专项测试

岗位职责

  • 负责语音大模型及实时语音交互系统的测试与质量保障,建立覆盖模型能力、功能、性能及稳定性的测试体系
  • 负责语音大模型测试方案设计与执行,围绕ASR、TTS、实时交互、全双工等能力,构建自动化测试及专项测试
  • 负责模型及推理服务的性能测试,围绕延迟、吞吐、资源利用率、并发能力等指标进行测试、分析与优化验证
  • 负责实时语音交互场景的端到端测试,覆盖流式输入输出、打断、状态切换、Tool Call等复杂交互场景,保障线上交互体验
  • 建设模型回归测试及Golden Case体系,对模型、推理服务及工程版本进行持续验证,及时发现版本迭代中的效果和稳定性问题
  • 参与线上问题定位与质量分析,协同算法、模型工程及平台团队推动问题发现、定位、修复和回归验证
  • 推动测试流程和自动化能力建设,提升模型研发及发布过程中的测试效率和质量保障能力

任职要求

  • 计算机、软件工程、人工智能、电子、通信等相关专业,本科及以上学历
  • 具备较强的软件测试和工程能力,有AI、大模型、语音或音频相关测试经验
  • 熟悉Python,具备较强的自动化测试开发能力,有C++开发经验者优先
  • 熟悉模型测试、接口测试、自动化测试等基本方法,能够独立设计和开发测试工具及测试框架
  • 理解语音大模型及实时语音交互基本原理,熟悉ASR、TTS、Realtime等语音能力者优先
  • 具备较强的数据分析和问题定位能力,能够从测试结果中定位模型、推理或系统层面的质量问题
  • 具备较强的责任心和跨团队协作能力,能够推动测试发现的问题闭环解决
  • 【加分项】有语音大模型、Realtime、Voice Agent、全双工交互等相关测试经验
  • 【加分项】有模型Benchmark、Golden Case、主客观评测体系建设经验
  • 【加分项】熟悉Locust、JMeter等性能测试工具,或有大规模并发服务测试经验
  • 【加分项】有模型效果回归、线上质量监控、版本灰度及发布验证经验
  • 【加分项】有语音数据分析、ASR/TTS指标评测或音频质量评测经验

加分项

  • 有语音大模型、Realtime、Voice Agent、全双工交互等相关测试经验
  • 有模型 Benchmark、Golden Case、主客观评测体系建设经验
  • 熟悉 Locust、JMeter 等性能测试工具,或有大规模并发服务测试经验
  • 有模型效果回归、线上质量监控、版本灰度及发布验证经验
  • 有语音数据分析、ASR/TTS 指标评测或音频质量评测经验