AI评估与强化学习工程师
岗位摘要
构建RLHF工具,收集并整合终端用户的偏好和反馈,使模型能够基于真实世界使用情况进行迭代自我改进;开发数据管道和AI评估框架,从终端用户视角跟踪模型性能、安全性、用户满意度以及留存和参与度等指标
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 构建RLHF工具,收集并整合终端用户的偏好和反馈,使模型能够基于真实世界使用情况进行迭代自我改进
- 开发数据管道和AI评估框架,从终端用户视角跟踪模型性能、安全性、用户满意度以及留存和参与度等指标
- 与产品和模型训练团队合作,优化AI驱动功能并将其投入生产
任职要求
- 具备将AI产品从原型扩展到全球部署的扎实能力
- 擅长开发稳健的AI评估方法,包括用于对齐和以用户为中心的改进的基准和指标
- 拥有RLHF或类似基于偏好的学习系统的实践经验
- 能在模糊环境中茁壮成长,基于反馈循环和数据驱动的洞察快速迭代
- 对AI创造变革性和以用户为中心的技术充满热情
- 自认为是连接研究与产品现实的高能动性构建者
- 在RLHF实施或AI对齐项目方面有经过验证的业绩记录
- 有在快节奏环境中为指标优化和模型自我改进构建数据管道的经验
- 熟悉评估工具和框架(例如,定制基准、AI的A/B测试、用户分析)
- 拥有展示评估工作和为提升用户影响进行功能开发的强大作品集或贡献
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。