大语言模型算法研究员-长文本方向
岗位摘要
参与长文本大语言模型的研发、部署与微调工作,包括功能实现、性能优化、系统调优及硬件适配;开展模型架构优化相关研发,提升模型训练与推理效率;根据业务需求复现相关自然语言处理算法;参与前沿算法与应用的研究工作
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与长文本大语言模型的研发、部署与微调工作,包括功能实现、性能优化、系统调优及硬件适配
- 开展模型架构优化相关研发,提升模型训练与推理效率
- 根据业务需求复现相关自然语言处理算法
- 参与前沿算法与应用的研究工作
任职要求
- 自然语言处理、机器学习或相关专业背景,具备3年以上相关工作经验
- 具备较强的算法开发能力,熟悉C++、Python、Shell、CUDA中的一种或多种编程语言
- 掌握传统NLP及深度学习NLP相关算法,并具有实际项目经验
- 熟练使用PyTorch、Megatron等深度学习框架
- 具有CUDA编程经验者优先考虑
- 对深度学习、Transformer架构及预训练技术有深入理解,能够根据论文复现相关算法,具有大规模预训练模型研发和训练经验者优先
- 在ACL、EMNLP、COLM、NAACL等顶级会议发表高质量论文的作者优先
工作地址
上海徐汇区模速空间505
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。