返回岗位列表

Anthropic

研究工程师

地点:远程 薪资:$350,000-$850,000 日期:2026-01-29

岗位摘要

设计和构建能够使用工具并在多样化环境中运行的自主AI系统,创建有助于理解和防御高级对抗性AI的模型有机体;创建评估和训练环境,以理解和塑造智能体行为,使其符合预期目标;开发能够在现实场景中检测、干扰或胜过对抗性AI系统的防御性智能体

岗位职责

  • 设计和构建能够使用工具并在多样化环境中运行的自主AI系统,创建有助于理解和防御高级对抗性AI的模型有机体
  • 创建评估和训练环境,以理解和塑造智能体行为,使其符合预期目标
  • 开发能够在现实场景中检测、干扰或胜过对抗性AI系统的防御性智能体
  • 将Claude与硬件平台(如机器人、物理系统)对接,以理解网络物理风险并制定防御措施
  • 将技术研究成果转化为有说服力的演示和成果,为政策制定者和公众提供信息
  • 与网络安全、国家安全和AI安全领域的外部专家合作,确定研究方向和验证研究成果

任职要求

  • 具备强大的软件工程技能,尤其是在Python方面
  • 拥有构建和使用基于LLM的智能体或自主系统的经验
  • 热衷于为范围模糊、高风险的问题寻找解决方案
  • 能够快速设计和运行实验,迭代推进以取得有用成果
  • 在协作环境中表现出色(团队热爱结对编程!)
  • 深切关注AI安全,并希望自己的工作能对人类应对高级AI产生实际影响
  • 能够独立负责整个问题的解决