返回岗位列表

Google DeepMind

AI模型安全研究科学家/工程师

地点:美国 薪资:$166,000-$244,000 日期:2026-01-22

岗位摘要

研究检测模型蒸馏及主动防御蒸馏的技术策略;设计并构建检测和缓解未经授权能力提取的系统;严格评估防御机制的有效性,权衡模型鲁棒性、防御效用与核心模型性能之间的平衡;与Google DeepMind、Google及业界的世界级研究人员紧密合作,发表开创性工作,建立新基准,并为负责任的AI防御设定标准

岗位职责

  • 研究检测模型蒸馏及主动防御蒸馏的技术策略
  • 设计并构建检测和缓解未经授权能力提取的系统
  • 严格评估防御机制的有效性,权衡模型鲁棒性、防御效用与核心模型性能之间的平衡
  • 与Google DeepMind、Google及业界的世界级研究人员紧密合作,发表开创性工作,建立新基准,并为负责任的AI防御设定标准

任职要求

  • 计算机科学或相关定量领域的博士学位,或拥有类似领域的学士/硕士学位并具备2年以上相关行业经验
  • 在模型安全、对抗性机器学习、后训练或模型评估等相关领域有研究或产品专长
  • 有设计和实施大规模机器学习系统或反滥用基础设施的经验
  • 在以下一个或多个领域有深厚专长:模型蒸馏、模型窃取、安全、记忆化、强化学习、监督微调或嵌入技术
  • 在对抗性机器学习方面有丰富经验,专注于设计和实施模型防御
  • 具备强大的软件工程技能,并有使用JAX、PyTorch或TensorFlow等机器学习框架的经验
  • 有在多团队环境中实现研究影响或交付生产系统的记录
  • 拥有当前或过往的美国安全许可