返回岗位列表

OpenAI

预训练安全研究员

地点:美国 薪资:薪资未公开 日期:2025-10-30

岗位摘要

开发新技术,以预测、测量和评估早期模型中的不安全行为;设计数据管理策略,以改进预训练先验知识并降低下游风险;探索安全设计架构和训练配置,以提高可控性;将新颖的安全导向损失函数、指标和评估引入预训练流程

岗位职责

  • 开发新技术,以预测、测量和评估早期模型中的不安全行为
  • 设计数据管理策略,以改进预训练先验知识并降低下游风险
  • 探索安全设计架构和训练配置,以提高可控性
  • 将新颖的安全导向损失函数、指标和评估引入预训练流程
  • 与跨职能安全团队密切合作,统一预训练和后训练的风险降低工作

任职要求

  • 具备开发或扩展预训练架构的经验(例如大语言模型、扩散模型、多模态模型等)
  • 熟悉训练基础设施、数据管道和评估框架(例如Python、PyTorch/JAX、Apache Beam)
  • 喜欢动手研究——设计、实施和迭代实验
  • 乐于与多样化的技术和跨职能合作伙伴(例如政策、法律、训练团队)协作