返回岗位列表

OpenAI

模型政策经理

地点:美国 薪资:薪资未公开 日期:2026-09-18

岗位摘要

设计并维护安全相关领域的模型政策,涵盖双重用途、代理系统和新兴前沿风险领域;将风险与危害模型转化为清晰的行为规范、评估标准、评分指南和系统级防护措施;界定AI有益用途与可能实质性助长伤害、剥削、滥用或不安全结果的协助之间的实际边界

岗位职责

  • 设计并维护安全相关领域的模型政策,涵盖双重用途、代理系统和新兴前沿风险领域
  • 将风险与危害模型转化为清晰的行为规范、评估标准、评分指南和系统级防护措施
  • 界定AI有益用途与可能实质性助长伤害、剥削、滥用或不安全结果的协助之间的实际边界
  • 构建支持模型训练、评估和部署的政策产物,并与安全研究人员、工程师、产品团队及其他相关方合作,将政策转化为可扩展的模型行为和可衡量的防护措施
  • 利用红队测试结果、部署数据、模型失败、过度拒绝、拒绝不足和模糊边缘案例,持续改进政策与评估质量
  • 识别前沿AI系统可能带来新安全挑战或降低伤害门槛的新兴能力领域
  • 研究真实部署情况,识别模型行为在何处成功、失败或偏离预期安全姿态
  • 将较长期的安全研究与实际的发布和部署工作相结合
  • 为系统卡、安全报告、政策文档、发布评审以及关于OpenAI模型安全与风险缓解方法的外部沟通做出贡献
  • 设计并运行人工数据活动,包括黄金集构建、标注指南、校准、裁决和评估覆盖分析,以确保政策能够被可靠衡量和改进

任职要求

  • 对先进AI系统如何影响现实风险具有强判断力,尤其是在模糊、快速变化或高影响领域
  • 具有为复杂技术、社会或对抗性系统构建或应用政策、分类体系、危害模型、威胁模型或风险框架的经验
  • 能够跨领域工作,不必在每个领域都是最深的主题专家,同时知道何时寻求专家意见
  • 能够将模糊问题转化为结构化的政策框架、评估标准、操作指南和可执行的模型行为
  • 习惯使用实证证据,包括实验、评估或部署数据等,来支持政策与风险评估决策

福利待遇

  • 提供搬迁支持
  • 采用混合办公模式:每周到办公室工作三天,周四和周五可选择居家办公