返回岗位列表

阶跃星辰

语音大模型评测工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

负责语音大模型的评测体系建设;设计并实现多维度评测框架,使模型能力可衡量、可对比、可解释;结合业务与模型目标,构建并维护评测集与 Benchmark;持续跟踪模型效果变化,推动模型能力优化

岗位职责

  • 负责语音大模型的评测体系建设
  • 设计并实现多维度评测框架,使模型能力可衡量、可对比、可解释
  • 结合业务与模型目标,构建并维护评测集与 Benchmark
  • 持续跟踪模型效果变化,推动模型能力优化
  • 持续跟踪语音大模型及多模态领域的前沿论文与开源社区进展
  • 将新的数据构建策略、评测方法快速落地到实际业务中
  • 以产品化和结果导向的视角发现问题
  • 基于数据与评测结果推动算法与模型能力的持续提升

任职要求

  • 本科及以上学历,计算机、人工智能、电子信息或相关专业
  • 熟练使用 Python / Go / Java / C++ 中至少一门语言
  • 具备独立编写脚本、调用 API、构建评测工具的能力
  • 在语音算法方向有较深入的实践经验
  • 对大模型有基础认知,使用过主流大语言模型
  • 能够快速理解 SFT、RLHF / RL 等核心概念
  • 有参与大模型 Benchmark / Evaluation / 数据集构建相关工作的经验者优先