大模型预训练算法研究员
岗位摘要
负责预训练数据的筛选、配比优化与知识边界拓展,深入专业领域挖掘高质量训练数据,助力模型从通才向专家进化;构建科学全面的模型评估体系,打破传统benchmark局限,从标准考试走向实战考验,为模型能力提供精准的深度诊断报告
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责预训练数据的筛选、配比优化与知识边界拓展,深入专业领域挖掘高质量训练数据,助力模型从通才向专家进化
- 构建科学全面的模型评估体系,打破传统benchmark局限,从标准考试走向实战考验,为模型能力提供精准的深度诊断报告
- 与顶尖工程团队协作设计高效架构,优化MoE模型结构,探索KV cache压缩等方案,提升推理速度与算力效率
- 探索Latent Reasoning、Test-Time Training等前沿技术方向,推动创新技术在超大规模模型上的实际落地应用
任职要求
- 国内外计算机、数学、人工智能等相关专业硕士及以上学历
- 具备独立研究能力,曾在机器学习或相关领域发表过一作论文
- 具备扎实的编程基础和优秀的工程能力,能够独立实现相关算法和实验
- 具有大模型领域的实习或科研经验者优先考虑
- 具备良好的团队协作能力和沟通能力,能与其他团队高效协作
福利待遇
- 有竞争力的日薪待遇(500-550元/天),表现优秀者可有转正机会
- 与顶尖工程团队并肩工作的机会,积累前沿大模型研发经验
- 参与从数据到模型再到评估的全链路技术实践,深入了解大模型预训练核心环节
- 紧跟学术前沿,探索Latent Reasoning、Test-Time Training等极具潜力的未来技术方向
工作地址
北京海淀区大恒科技大厦南座
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。