LLM模型能力实习生
岗位摘要
负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据;研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量;深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型整体表现
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责大语言模型(LLM)相关的数据研究工作,包括数据获取、清洗、筛选、规模化构建和生成高质量数据
- 研究与优化LLM的模型和数据评估方法,通过训练不同规模的大模型来评估和提升数据质量
- 深入探索LLM的data recipe,包括数据比例的优化和运维实验,以提升模型整体表现
- 探索先进的数据集合成技术,为大语言模型提供高质量合成tokens
任职要求
- 985高校本科或以上在读,专业为Math/CS/AI/ML/CV/NLP/Speech或相关STEM专业
- 具备大规模模型训练的相关经验,熟悉Megatron、Huggingface等主流框架
- 对数据质量有严格标准,能够对交付的数据进行细致评审与优化
- 具备扎实的数据结构与算法基础,熟练使用Python编程语言,熟悉PyTorch/CUDA编程
- 熟悉Spark、Ray等分布式计算框架
- 编程竞赛获奖者优先,如ACM/NOI
- 责任心强,积极主动,具备良好的沟通能力和团队合作精神
福利待遇
- 薪资500-1000元/天,薪酬优厚
- 位于北京海淀区京东科技大厦,工作环境便利
- 深入参与前沿大语言模型研究,积累核心实战经验
- 与顶尖团队协作,职业发展空间大
工作地址
北京海淀区京东科技大厦13层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。