AI模型推理评估员
岗位摘要
评估模型输出的事实准确性、逻辑连贯性、谬误推理和隐藏假设;识别细微的意识形态影响、统计谬误和修辞技巧;撰写体现知识诚实性、来源评估、主次来源权衡以及置信度界定的示范性推理文本;构建对抗性示例和红队提示,以暴露模型剩余的认知弱点
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 评估模型输出的事实准确性、逻辑连贯性、谬误推理和隐藏假设
- 识别细微的意识形态影响、统计谬误和修辞技巧
- 撰写体现知识诚实性、来源评估、主次来源权衡以及置信度界定的示范性推理文本
- 构建对抗性示例和红队提示,以暴露模型剩余的认知弱点
- 参与定义和扩展旨在寻求真相行为的宪法原则
任职要求
- 在高严谨性领域有已发表的学术成果或受过相关学术训练
- 在预测(如Metaculus, Good Judgment)、严谨分析或公开纠错方面有良好记录
- 在以下至少三个领域有深厚知识:科学哲学、认知心理学、统计学、逻辑学、语言学、历史学、经济学或相关学科
- 能够公正地理解对立观点,并区分既定知识与推测
- 习惯依赖一手资料和基础概率
- 具备情报分析、调查性新闻或学术同行评审经验者优先
福利待遇
- 时薪为总薪酬方案的一部分
- 具体福利因国家/地区而异,根据居住地可能享有医疗福利
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。