数据标注专员(安全方向)
岗位摘要
评估并改进模型安全性:标注、排序、审核和优化人工及模型生成的文本,以提高安全性、质量和政策合规性,包括可能涉及性、暴力或心理不适的内容;应用细致的安全判断:根据详细的安全指南、评分标准和风格标准评估模型输出,在模糊、敏感和依赖上下文的情况下做出一致决策
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 评估并改进模型安全性:标注、排序、审核和优化人工及模型生成的文本,以提高安全性、质量和政策合规性,包括可能涉及性、暴力或心理不适的内容
- 应用细致的安全判断:根据详细的安全指南、评分标准和风格标准评估模型输出,在模糊、敏感和依赖上下文的情况下做出一致决策
- 创建提示词和安全测试用例:编写逼真的提示词、用户场景和对抗性示例,帮助评估模型在不同安全类别下的行为,发现不安全、回避、过度拒绝或不符合政策的响应
- 支持质量和校准:识别标注不一致或指南不清晰的问题,针对反复出现的边缘案例、模型失败和改进数据质量的机会提供可操作的反馈
- 精确且独立地工作:以高度注重细节的方式完成标注任务,同时能够在全球分布式团队中独立工作
任职要求
- 具备信任与安全、内容审核、AI模型评估或相关领域的背景和技能
- 具备强大的情境判断能力、文化和偏见敏感性
- 有经验应用细致指南处理复杂或模糊内容
- 高度注重细节,能够评估不同用户意图和场景下的安全风险
- 在入职培训后能够独立做出一致、合理的决策
- 能够接受接触明确敏感内容(包括性、暴力或心理不适内容)
- 拥有自己的笔记本电脑(BYOD)
- 能够承诺每周至少工作16小时
福利待遇
- 兼职远程工作,灵活安排时间
- 合同费率:45加元/小时(加拿大)或40美元/小时(美国),包含基础工资和危险津贴
- 12个月合同,有续签可能
- 参与前沿AI安全领域工作,对模型改进产生持久影响
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。