AI模型安全研究科学家/工程师
岗位摘要
研究检测模型蒸馏及主动防御蒸馏的技术策略;设计并构建检测和缓解未经授权能力提取的系统;严格评估防御机制的有效性,权衡模型鲁棒性、防御效用与核心模型性能之间的平衡;与Google DeepMind、Google及业界的世界级研究人员紧密合作,发表开创性工作,建立新基准,并为负责任的AI防御设定标准
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究检测模型蒸馏及主动防御蒸馏的技术策略
- 设计并构建检测和缓解未经授权能力提取的系统
- 严格评估防御机制的有效性,权衡模型鲁棒性、防御效用与核心模型性能之间的平衡
- 与Google DeepMind、Google及业界的世界级研究人员紧密合作,发表开创性工作,建立新基准,并为负责任的AI防御设定标准
任职要求
- 计算机科学或相关定量领域的博士学位,或拥有类似领域的学士/硕士学位并具备2年以上相关行业经验
- 在模型安全、对抗性机器学习、后训练或模型评估等相关领域有研究或产品专长
- 有设计和实施大规模机器学习系统或反滥用基础设施的经验
- 在以下一个或多个领域有深厚专长:模型蒸馏、模型窃取、安全、记忆化、强化学习、监督微调或嵌入技术
- 在对抗性机器学习方面有丰富经验,专注于设计和实施模型防御
- 具备强大的软件工程技能,并有使用JAX、PyTorch或TensorFlow等机器学习框架的经验
- 有在多团队环境中实现研究影响或交付生产系统的记录
- 拥有当前或过往的美国安全许可
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。