AI内容安全运营专家
岗位摘要
保障线上AI生成业务安全运营,构建大模型内容安全核心指标(拦截率、漏/误拦截率等),深入分析Badcase并产出分析报告,挖掘策略漏洞或执行偏差,推动策略机制优化,保持用户体验前提下持续降低漏/误拦截率
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 保障线上AI生成业务安全运营,构建大模型内容安全核心指标(拦截率、漏/误拦截率等),深入分析Badcase并产出分析报告,挖掘策略漏洞或执行偏差,推动策略机制优化,保持用户体验前提下持续降低漏/误拦截率
- 模型数据安全审核,管理模型训练集和测试集,优化安全大模型、机审模型;参与模型调优与效果评估,结合业务场景设计评测方案,对模型基础安全能力进行全流程把关
- 组织红蓝攻防对抗测试,主动发现大模型安全漏洞,设计针对性防御机制与拦截策略,推动漏洞修复与防护体系升级,持续降低模型回复风险率
- 联动算法、工程、产品团队搭建安全运营体系,结合AI工具提效各环节工作,提高产出质量
- 结合国家法律法规及监管要求,持续更新内容安全审核规则和防御策略,应急处置和监管应对
- 跟踪AIGC内容安全前沿动态,提高对AI新型安全漏洞(如提示词注入、越狱攻击、claw框架下信息泄露、深度伪造、AI换脸)等风险的治理方案
任职要求
- 本科及以上学历,4年及以上互联网内容安全运营、风控运营或大模型/AIGC类产品安全运营相关经验,有大厂风控/安全运营经验优先
- 熟悉主流内容安全策略框架及审核流程,具备产品思维,能从用户体验、风险管理等多维度推动安全策略优化
- 具备扎实的数据分析能力,能熟练运用SQL/Python等工具进行数据处理与分析
- 具备良好的项目推动与跨团队协作能力,能协调产品、研发、外包等团队高效落地安全策略,有跨团队推动经验优先
- 学习能力强,善于归纳总结与沉淀方法论。具备很强的责任心和自驱意识,热爱AI领域,能够适应快速变化的安全挑战
- 有内容安全AI提效经验优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。