AI音乐和音频-强化学习算法工程师
岗位摘要
负责生成任务的大语言模型(LLM)及生成式模型的强化学习优化,提升音频或音乐任务的理解与生成质量;跟踪人工智能最新进展,重点关注强化学习RL的微调技术;测量和基准测试模型及应用程序性能
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责生成任务的大语言模型(LLM)及生成式模型的强化学习优化,提升音频或音乐任务的理解与生成质量
- 跟踪人工智能最新进展,重点关注强化学习RL的微调技术
- 测量和基准测试模型及应用程序性能
- 推动RL特定领域数据集的收集、构建和标注,针对不同任务、工具和应用程序构建RLHF链路
- 在协作团队环境中参与创新、发现问题、推荐解决方案并执行分类
- 与各团队协作,推进新产品功能开发及现有产品改进
任职要求
- 计算机科学、电气工程、人工智能、应用数学等专业硕士或博士学位,具有行业经验
- 熟悉LLM模型强化学习、多模态强化学习、图像生成或音频生成强化学习的开发方法、推理和工具交互
- 具备优秀的PyTorch和Python编程技能,扎实的编程、优化和软件设计基础
- 具有深度学习、大模型算法、自然语言处理算法相关经验
- 有优秀开源项目经历或发表算法相关优秀论文者优先
- 有算法工程化经验和团队管理经验者优先
- 参加算法相关竞赛并获奖者优先
福利待遇
- 薪资50-70K·13薪
工作地址
北京东城区明阳国际中心111
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。