返回岗位列表

Anthropic

研究科学家/工程师(诚实性方向)

地点:美国 薪资:$350,000-$500,000 日期:2026-01-29

岗位摘要

设计和实施新颖的数据整理流程,以根据模型的知识识别、验证和筛选训练数据的准确性;开发专门的分类器,以检测模型可能产生的幻觉或校准不当的声明;创建和维护全面的诚实性基准和评估框架;实施将模型输出基于已验证信息的技术,例如搜索和检索增强生成(RAG)系统

岗位职责

  • 设计和实施新颖的数据整理流程,以根据模型的知识识别、验证和筛选训练数据的准确性
  • 开发专门的分类器,以检测模型可能产生的幻觉或校准不当的声明
  • 创建和维护全面的诚实性基准和评估框架
  • 实施将模型输出基于已验证信息的技术,例如搜索和检索增强生成(RAG)系统
  • 设计和部署专门用于识别和纠正校准不当响应的人类反馈收集机制
  • 设计和实施提示词管道,以生成提高模型准确性和诚实性的数据
  • 开发和测试新颖的强化学习环境,以奖励真实输出并惩罚捏造的声明
  • 创建工具,帮助人类评估者高效评估模型输出的准确性

任职要求

  • 拥有计算机科学、机器学习或相关领域的硕士/博士学位
  • 具备扎实的Python编程技能
  • 拥有语言模型微调和分类器训练的行业经验
  • 在实验设计和统计分析方面表现出熟练度,用于衡量校准和准确性的改进
  • 关心AI安全以及当前和未来AI系统的准确性和诚实性
  • 拥有数据科学或为微调LLM创建和整理数据集的经验
  • 理解模型输出中各种不确定性、校准和真实性的度量标准