Researcher Alignment San Francisco
岗位摘要
开发和评估主观、依赖上下文且难以衡量的对齐能力;设计评估方法,可靠地衡量风险以及与人类意图和价值观的对齐程度;构建工具和评估方法,研究和测试模型在不同情况下的鲁棒性;设计实验,了解对齐如何随着计算、数据、上下文和行动长度以及对手资源的变化而扩展的规律
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发和评估主观、依赖上下文且难以衡量的对齐能力
- 设计评估方法,可靠地衡量风险以及与人类意图和价值观的对齐程度
- 构建工具和评估方法,研究和测试模型在不同情况下的鲁棒性
- 设计实验,了解对齐如何随着计算、数据、上下文和行动长度以及对手资源的变化而扩展的规律
- 设计和评估新的人机交互范式和可扩展的监督方法,重新定义人类如何与模型交互、理解和监督模型
- 训练模型以校准正确性和风险
- 设计使用AI进行对齐研究的新方法
任职要求
- 团队合作者——愿意完成推动团队前进的各种任务
- 拥有计算机科学、计算科学、数据科学、认知科学或类似领域的博士学位或同等研究经验
- 具备强大的工程技能,特别是在设计和优化大规模机器学习系统方面(例如PyTorch)
- 深入了解对齐算法和技术背后的科学
- 能够开发数据可视化或数据收集界面(例如TypeScript、Python)
- 喜欢快节奏、协作和前沿的研究环境
- 专注于开发可信赖、安全和可靠的AI模型,尤其是在高风险场景中
福利待遇
- 提供搬迁援助
- 采用混合工作模式(每周3天在办公室)
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。