返回岗位列表

阶跃星辰

语音大模型评测工程师

地点:北京 薪资:40-70K 日期:2026-03-03

岗位摘要

负责语音大模型的评测体系建设,设计并实现多维度评测框架,使模型能力可衡量、可对比、可解释;结合业务与模型目标,构建并维护评测集与Benchmark,持续跟踪模型效果变化,推动模型能力优化

岗位职责

  • 负责语音大模型的评测体系建设,设计并实现多维度评测框架,使模型能力可衡量、可对比、可解释
  • 结合业务与模型目标,构建并维护评测集与Benchmark,持续跟踪模型效果变化,推动模型能力优化
  • 持续跟踪语音大模型及多模态领域的前沿论文与开源社区进展,将新的数据构建策略、评测方法快速落地到实际业务中
  • 以产品化和结果导向的视角发现问题,基于数据与评测结果推动算法与模型能力的持续提升

任职要求

  • 本科及以上学历,计算机、人工智能、电子信息或相关专业
  • 熟练使用Python/Go/Java/C++中至少一门语言,具备独立编写脚本、调用API、构建评测工具的能力
  • 在语音算法方向有较深入的实践经验,对大模型有基础认知,使用过主流大语言模型,能够快速理解SFT、RLHF/RL等核心概念
  • 有参与大模型Benchmark/Evaluation/数据集构建相关工作的经验者优先

工作地址

北京海淀区大恒科技大厦南座