后训练算法研究员/工程师
岗位摘要
深度参与CodeLLM的数据处理、清洗与优化,科学改进、筛选并平衡用于大模型预训练与对齐的数据质量,提升模型在Pretrain和SFT阶段的代码及智能体能力;积极参与通过SFT(监督微调)、RL(强化学习)以及构建/扩展工具、Docker环境和任务来提升Coding/SWE Agent能力,亲身积…
岗位职责
- 深度参与CodeLLM的数据处理、清洗与优化,科学改进、筛选并平衡用于大模型预训练与对齐的数据质量,提升模型在Pretrain和SFT阶段的代码及智能体能力
- 积极参与通过SFT(监督微调)、RL(强化学习)以及构建/扩展工具、Docker环境和任务来提升Coding/SWE Agent能力,亲身积累有效训练智能体模型的实践经验
- 深入探索提升模型解题能力的方法,目标包括:在简单和中等算法题上达到接近100%的准确率;最大化难题(IOI/ICPC级别)的解题率,推动模型智能上限
- 提升用户在代码/软件工程相关问题上的解决率与满意度,使模型真正易用且令人愉悦
任职要求
- 本科及以上学历,计算机科学、人工智能、自动化、数学或相关专业优先
- 扎实的编程基础,对数据结构和算法设计有深刻理解;熟练掌握Python、C++等一种或多种主流编程语言;熟悉PyTorch、TensorFlow、Hugging Face等深度学习框架和库
- 具有丰富的大模型预训练和对齐训练实践经验,或有Code/SWE优化经验者优先
- 在顶级学术会议发表论文或在机器学习和AI领域取得突出成就者优先
- 具有算法竞赛获奖经历(如ACM、IOI、NOI、Top Coder)者加分
- 责任心强,积极主动,具备良好的沟通与团队协作能力