AIGC算法工程师/研究员
岗位摘要
研发适用于视觉生成任务的文生图基座大模型和图像编辑大模型后训练算法RLHF,显著超越Stable Diffusion、Flux以及QWen-image等开源基座模型;设计并研发RLHF奖赏模型,从美学评分、指令遵循、文字渲染以及肢体优化等多个维度提升生成模型后训练上限
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研发适用于视觉生成任务的文生图基座大模型和图像编辑大模型后训练算法RLHF,显著超越Stable Diffusion、Flux以及QWen-image等开源基座模型
- 设计并研发RLHF奖赏模型,从美学评分、指令遵循、文字渲染以及肢体优化等多个维度提升生成模型后训练上限
- 基于Diffusion/AR生成模型构建更高效的强化学习系统,探索RLHF在视觉生成领域的scaling law
任职要求
- 两年左右视觉生成领域工作经验,熟悉自然语言/多模态大模型基本原理,对GAN、VQ-VAE、Diffusion Model和AutoRegressive等流行算法有实践经验,对MDP、Policy Gradient、Q-Learning、TRPO、PPO和GRPO等深度强化学习核心算法有深刻理解,有相关方向顶会论文、知名开源项目或重要产品落地经验者优先
- 优秀的编程能力,熟练使用PyTorch,熟悉Megatron分布式训练框架,对OpenRLHF、ROLL和VERL等开源RL框架熟悉更优
- 熟悉AIGC应用数据准备全流程,包括数据采集、清洗、标注等,对人工合成高质量训练数据有深入理解
- 有强烈的责任心,良好的团队合作能力和跨团队沟通能力
福利待遇
- 具有竞争力的薪酬待遇 40-70K·16薪
- 参与前沿AIGC视觉生成技术研发,有机会接触行业顶尖算法与工程实践
- 扁平化管理,良好的团队合作与跨团队沟通氛围
工作地址
北京海淀区大恒科技大厦9楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。