自动化红队研究员
岗位摘要
负责自动化红队在灾难性风险领域的研究和技术方向,初始重点包括:自动化分类器越狱发现(网络和生物)、自动化生物威胁开发诱导(最坏可行规划提升)、思维链监控规避探测(及相关的失控评估)
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责自动化红队在灾难性风险领域的研究和技术方向,初始重点包括:自动化分类器越狱发现(网络和生物)、自动化生物威胁开发诱导(最坏可行规划提升)、思维链监控规避探测(及相关的失控评估)
- 与垂直风险团队(网络、生物、失控)紧密合作,定义威胁模型、确定优先级并落实缓解措施
- 与分类器团队合作,将发现的攻击转化为训练数据、评估和可衡量的鲁棒性提升
- 与产品、工程和安全利益相关者合作,确保自动化红队的输出在操作上有用
任职要求
- 对AI安全有强烈兴趣,并致力于减少现实世界的灾难性风险
- 喜欢(负责任地)破坏系统,能从发现奇怪、高严重性的故障模式并将其转化为具体修复中获得能量
- 具备强大的应用研究直觉,特别是在评估方面:擅长设计可重复、可解释且难以欺骗的实验
- 拥有LLM和智能体的实践经验,包括多轮行为、工具使用以及模型适应约束的方式
- 能够构建可扩展的自动化系统,而不仅仅是原型——能将红队想法转化为持续运行并产生高信号输出的管道
- 具备扎实的软件工程基础(数据结构、算法、测试纪律),能在接近生产的环境中有效工作
- 以威胁模型和激励机制思考,自然地问“攻击者下一步会做什么?”或“这在压力下会如何失败?”
- 能将混乱的发现转化为行动,与研究人员、工程师、产品和政策清晰沟通,并推动就优先修复什么达成一致
- 注重效率和优先级,乐于对低杠杆工作说“不”,专注于影响风险的关键点
- 加分项:在对抗性机器学习、安全研究/红队、滥用预防系统或大规模评估基础设施方面有经验
福利待遇
- 参与前沿AI安全研究,对全球安全产生深远影响
- 与顶尖的研究人员、工程师和产品团队合作
- 在快节奏、高影响力的环境中工作,推动公司和社会进步
- 有机会将研究成果转化为实际生产改进
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。