返回岗位列表

Anthropic

保障措施技术项目经理(模型发布方向)

地点:远程 薪资:$290,000-$365,000 日期:2026-01-29

岗位摘要

全面负责模型发布的端到端保障措施就绪工作,从发布前规划到发布后稳定,确保分类器系统为每个新模型版本正确配置、测试和扩展;协调复杂的跨平台部署,管理分类器在各个平台的推出,每个平台都有不同的基础设施限制、容量要求和部署时间表

岗位职责

  • 全面负责模型发布的端到端保障措施就绪工作,从发布前规划到发布后稳定,确保分类器系统为每个新模型版本正确配置、测试和扩展
  • 协调复杂的跨平台部署,管理分类器在各个平台的推出,每个平台都有不同的基础设施限制、容量要求和部署时间表
  • 在快速推进、时间紧迫的发布周期中,实时做出技术权衡决策,平衡分类器容量、延迟影响、误报率和鲁棒性要求之间的竞争性约束
  • 与推理团队合作,推动容量规划和性能优化,建模计算需求,优化分类器配置(批处理大小、网格拓扑、芯片分配),确保在满足安全要求的同时保持在开销预算内
  • 在发布日担任保障措施的主要联络人,领导作战室协调工作,协调监控、排查分类器问题,并推动部署决策的“执行/中止”判断
  • 制定详细的执行计划和流程清单,创建全面的发布检查表,涵盖分类器配置、监控阈值、警报设置、回滚程序和跨团队依赖关系
  • 与产品团队合作进行联合发布协调,确保新的产品界面配置、测试和部署了适当的保障措施保护,无论是独立发布还是与新模型一同发布
  • 监控并响应误报模式,跟踪各客户群体的标记率,识别有问题的模式,与研发团队协调分类器再训练的优先级,并管理企业客户的豁免流程
  • 管理向日常运营的过渡,一旦发布稳定,将正在进行的监控和优化工作协调移交给持续工程团队,然后根据需要转向下一个模型或产品发布
  • 维护技术文档,记录分类器部署配置、容量估算、性能基准和经验教训,以积累机构知识

任职要求

  • 在ML/AI系统方面拥有深厚的技术项目管理经验,拥有多年协调涉及模型推理、分布式系统和规模化实时生产服务的复杂部署的经验
  • 具有AI安全或信任与安全方面的经验,熟悉误报/漏报权衡、对抗性鲁棒性、内容审核系统或类似的安全关键型技术系统概念
  • 能够应对高度模糊的技术挑战,综合来自多个工程团队的不完整信息,识别关键路径障碍,并在面临不确定性时推动决策