预训练语言模型研究员
岗位摘要
参与大规模预训练语言模型的预训练,包括Scaling Law构建、性能优化及硬件适配;根据需求复现相关自然语言处理算法;参与前沿算法与应用的研究;自然语言处理、机器学习及相关专业背景,3年以上相关工作经验
岗位职责
- 参与大规模预训练语言模型的预训练,包括Scaling Law构建、性能优化及硬件适配
- 根据需求复现相关自然语言处理算法
- 参与前沿算法与应用的研究
任职要求
- 自然语言处理、机器学习及相关专业背景,3年以上相关工作经验
- 较强的算法开发能力,熟悉C++、Python、Shell、CUDA等至少一种编程语言
- 掌握传统NLP及深度学习NLP算法,并具备实战经验
- 熟练使用PyTorch、Megatron等深度学习框架
- 对深度学习、Transformer及预训练有深入理解,能复现论文算法,有大规模预训练模型经验者优先
- 在ACL、EMNLP、COLING、NAACL等顶级会议发表论文者优先