研究工程师(AI安全评估)
岗位摘要
设计和运行实验以提高评估质量,包括开发生成代表性测试数据、模拟真实用户行为和验证评分准确性的方法;研究不同因素(多轮对话、工具、长上下文、用户多样性)如何影响模型的安全行为;分析评估覆盖范围,以识别差距并确定需要改进测量的领域
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计和运行实验以提高评估质量,包括开发生成代表性测试数据、模拟真实用户行为和验证评分准确性的方法
- 研究不同因素(多轮对话、工具、长上下文、用户多样性)如何影响模型的安全行为
- 分析评估覆盖范围,以识别差距并确定需要改进测量的领域
- 将成功的研究成果产品化,集成到在模型训练、发布及之后运行的评估流水线中
- 与政策和执行团队合作,将现实世界的危害模式转化为可衡量的评估
- 构建工具,使政策专家能够创建和迭代评估
- 向研究和训练团队展示发现,以推动上游模型改进
任职要求
- 拥有4年以上软件工程或机器学习工程经验
- 精通Python,并能熟练处理全栈工作
- 熟悉数据分析,并能从大型数据集中提取见解
- 有大型语言模型(LLM)经验,了解其能力和失败模式
- 能够在原型设计和生产级代码之间流畅切换
- 对模糊问题感到兴奋,并能将其转化为具体的实验
- 深切关注AI安全,并希望自己的工作产生实际影响
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。