Software Engineer Applied Evals San Francisco
岗位摘要
定义推动OpenAI模型改进的核心评估信号,将模糊的产品差距转化为清晰、可辩护的质量衡量标准;设计可靠、可重复且可扩展的代理、约束和评估管道;通过真实工作流程原型化解决方案,并将其转化为可扩展的反馈循环
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 定义推动OpenAI模型改进的核心评估信号,将模糊的产品差距转化为清晰、可辩护的质量衡量标准
- 设计可靠、可重复且可扩展的代理、约束和评估管道
- 通过真实工作流程原型化解决方案,并将其转化为可扩展的反馈循环
- 将评估信号直接连接到研究和训练系统,确保产品改进体现在用户体验中
- 通过与工程、研究和产品团队合作,塑造模型交互范式,决定模型的部署和测量方式
- 构建可重复使用的系统和工具,使公司内部能够广泛贡献,并逐步提高质量标准
任职要求
- 拥有4年以上软件工程经验,具备扎实的基础和端到端交付生产系统的记录
- 有构建AI代理或应用程序的经验,包括设计评估和通过提示或脚手架提高性能
- 熟悉LLM的评估方法,并曾使用多代理工作流、工具使用或长上下文等模式
- 熟悉深度学习概念或有训练模型的经验
- 能够清晰地向技术和非技术受众传达信息
- 热衷于与研究及产品团队的高影响力合作,并在模糊环境中茁壮成长
福利待遇
- 提供搬迁援助
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。