实习-后训练与智能体算法工程师
岗位摘要
研究实用的后对齐强化学习算法,打造稳定鲁棒的推理与智能体强化学习训练体系;探索超大规模模型,并进行极致系统优化;负责基础模型后训练端到端指标优化;开展代码智能体与通用智能体的数据建设和模型优化工作
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究实用的后对齐强化学习算法,打造稳定鲁棒的推理与智能体强化学习训练体系
- 探索超大规模模型,并进行极致系统优化
- 负责基础模型后训练端到端指标优化
- 开展代码智能体与通用智能体的数据建设和模型优化工作
- 探索智能体在真实应用场景中的优化方案
任职要求
- 国内外高校研究生在读,人工智能、计算机、自动化、数学相关专业优先
- 具备扎实的机器学习基础,熟悉自然语言处理、强化学习领域技术,在ACL/EMNLP/NAACL/NeurIPS/ICML/ICLR等顶级会议发表论文者优先
- 拥有优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++或Python,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先
- 在大模型领域、智能体领域或强化学习领域,主导过具有重大影响力的项目或论文者优先
- 具备出色的问题分析和解决能力,能深入解决大模型训练和应用中存在的问题,具有自主探索解决方案的能力
- 具备良好的沟通协作能力,能与团队共同探索新技术,推进技术进步
福利待遇
- 日薪300-500元
- 每周工作4天,实习期3个月
- 参与前沿大模型与智能体技术研究
- 获得顶级会议论文发表机会
工作地址
北京海淀区大恒科技大厦南座12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。