超拟人语音交互SFT数据专家
岗位摘要
设计面向超拟人语音交互场景的SFT数据方案,覆盖角色人设一致性、多轮对话逻辑、情感表达等维度,构建高质量对话语料;针对多模态交互、AI陪伴等需求,设计角色扮演数据的标注规范,包括身份背景、经典台词、行为模式等细粒度标签
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计面向超拟人语音交互场景的SFT数据方案,覆盖角色人设一致性、多轮对话逻辑、情感表达等维度,构建高质量对话语料
- 针对多模态交互、AI陪伴等需求,设计角色扮演数据的标注规范,包括身份背景、经典台词、行为模式等细粒度标签
- 基于儿童教育、情感陪伴、游戏NPC、模拟面试等业务场景,设计符合角色设定的对话逻辑,提升用户交互沉浸感
- 建立SFT数据评估体系,针对人设一致性、意图识别准确率、对话流畅度等指标进行量化分析与迭代
- 结合ASR→LLM→TTS语音交互链路,通过SFT技术优化大模型的上下文理解、情感响应准确度及多轮对话连贯性
- 探索角色扮演数据在语音Agent中的应用,通过Prompt工程控制对话风格与情绪倾向,实现个性化交互体验
- 协同声纹识别、情感计算等技术,构建语音-文本-用户画像对齐的数据集,支持儿童声线识别、成人情感分析等个性化交互
- 推动SFT数据在低延迟语音交互场景的落地,优化实时打断、长上下文记忆等端到端响应能力
任职要求
- 具备SFT数据构建经验,熟悉虚拟客服、游戏NPC、AI陪伴等垂域场景的对话数据标注与质量评估流程
- 掌握角色扮演数据集特性(如CoSER、ChatHaruhi等),能够设计符合人设的对话逻辑,解决长上下文依赖、身份一致性等问题
- 熟悉语音交互链路(ASR/LLM/TTS),能针对韵律、停顿、副语言等语音数据特点制定SFT优化策略
- 有语音大模型SFT项目经验,熟悉多语言自然对话数据等主流数据集的应用者优先
- 具备语言学或心理学背景,能分析对话中的情感意图与社会常识映射,提升拟人化表达自然度者优先
- 熟悉AI Agent数据框架,有基于SFT/RLHF的对话策略优化经验者优先
加分项
- 有语音大模型SFT项目经验,熟悉主流数据集(如多语言自然对话数据)的应用
- 具备语言学或心理学背景,能分析对话中的情感意图、社会常识映射,提升拟人化表达自然度
- 熟悉AI Agent数据框架,有基于SFT/RLHF的对话策略优化经验者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。