返回岗位列表

OpenAI

Researcher Alignment San Francisco

地点:美国 薪资:$295K-$440K 日期:2026-01-29

岗位摘要

开发和评估主观、依赖上下文且难以衡量的对齐能力;设计评估方法,可靠地衡量风险以及与人类意图和价值观的对齐程度;构建工具和评估方法,研究和测试模型在不同情况下的鲁棒性;设计实验,了解对齐如何随着计算、数据、上下文和行动长度以及对手资源的变化而扩展的规律

岗位职责

  • 开发和评估主观、依赖上下文且难以衡量的对齐能力
  • 设计评估方法,可靠地衡量风险以及与人类意图和价值观的对齐程度
  • 构建工具和评估方法,研究和测试模型在不同情况下的鲁棒性
  • 设计实验,了解对齐如何随着计算、数据、上下文和行动长度以及对手资源的变化而扩展的规律
  • 设计和评估新的人机交互范式和可扩展的监督方法,重新定义人类如何与模型交互、理解和监督模型
  • 训练模型以校准正确性和风险
  • 设计使用AI进行对齐研究的新方法

任职要求

  • 团队合作者——愿意完成推动团队前进的各种任务
  • 拥有计算机科学、计算科学、数据科学、认知科学或类似领域的博士学位或同等研究经验
  • 具备强大的工程技能,特别是在设计和优化大规模机器学习系统方面(例如PyTorch)
  • 深入了解对齐算法和技术背后的科学
  • 能够开发数据可视化或数据收集界面(例如TypeScript、Python)
  • 喜欢快节奏、协作和前沿的研究环境
  • 专注于开发可信赖、安全和可靠的AI模型,尤其是在高风险场景中

福利待遇

  • 提供搬迁援助
  • 采用混合工作模式(每周3天在办公室)