研究科学家,智能体鲁棒性
岗位摘要
研究AI智能体能力的科学,重点关注其与安全性、风险因素及基准测试方法的关系;设计和构建测试框架,评估AI智能体在用户压力或环境诱导下采取有害行为的倾向;设计和构建针对AI智能体在编码、网页浏览和计算机使用等能力增强时出现的新独特故障模式的利用和缓解措施
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究AI智能体能力的科学,重点关注其与安全性、风险因素及基准测试方法的关系
- 设计和构建测试框架,评估AI智能体在用户压力或环境诱导下采取有害行为的倾向
- 设计和构建针对AI智能体在编码、网页浏览和计算机使用等能力增强时出现的新独特故障模式的利用和缓解措施
- 描述并设计针对多个交互AI智能体系统潜在故障模式或更广泛风险的缓解措施
任职要求
- 致力于推动前沿AI能力持续进步时行业安全、可靠和可信的AI部署使命
- 具备协作进行技术研究的实践经验,能够构建和利用智能体脚手架、设计评估框架,并快速将研究文献中的新想法转化为工作原型
- 具备后训练和强化学习技术经验,如RLHF、DPO、GRPO及类似方法
- 在机器学习领域有已发表的研究成果,特别是在生成式AI方面
- 至少三年处理复杂机器学习问题的经验,无论是在研究环境还是产品开发中
- 具备出色的书面和口头沟通能力,能在跨职能团队中工作
- 优先考虑:具备智能体评估框架(如SWE-bench、WebArena、OSWorld、Inspect或类似工具)的实践经验
- 优先考虑:具备红队测试、提示注入或AI系统对抗性测试的经验
福利待遇
- 有竞争力的薪资和股权激励
- 全面的福利待遇
- 与顶尖AI研究团队合作的机会
- 研究成果公开发表的机会
- 跨行业、公共部门和学术界的广泛合作
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。