大语言模型研究员
岗位摘要
深度参与LLM的模型结构改进,包括MLP以及attention模块;参与训练方法的设计,包括模型并行策略优化、优化算法改进、量化算法改进、目标损失函数改进等方向;目标是在模型训练及大规模推理效率上取得SOTA级别的领先水平
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 深度参与LLM的模型结构改进,包括MLP以及attention模块
- 参与训练方法的设计,包括模型并行策略优化、优化算法改进、量化算法改进、目标损失函数改进等方向
- 目标是在模型训练及大规模推理效率上取得SOTA级别的领先水平
- 深入调研如何设计科学的实验,利用scaling law验证模型设计
- 获取从头开始、端到端的大模型训练经验
任职要求
- 本科及以上学历,计算机、人工智能、自动化、数学专业优先
- 扎实的编程基础,对数据结构、算法设计基础有深度了解
- 熟练使用PyTorch或其他深度学习框架
- 有高性能计算经验者优先
- 有ACM/IOI/NOI/Top Coder等算法竞赛获奖经历者优先
- 在顶级学术会议上发表论文者优先
- 在机器学习、人工智能领域内获得过优异成绩者优先
- 责任心强,积极主动,有良好的沟通和合作能力
福利待遇
- 良好的团队氛围
- 扁平化的沟通和管理
- 丰富的算力和计算资源
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。