基础设施工程师(大模型方向)
岗位摘要
负责分布式训练系统的设计与优化;参与推理优化、训练框架、RL系统、平台和网络等方向的研发工作;支持大规模分布式系统和云原生/K8s环境的搭建与维护;进行CUDA/GPU编程、性能优化或分布式训练加速技术的应用与改进
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责分布式训练系统的设计与优化
- 参与推理优化、训练框架、RL系统、平台和网络等方向的研发工作
- 支持大规模分布式系统和云原生/K8s环境的搭建与维护
- 进行CUDA/GPU编程、性能优化或分布式训练加速技术的应用与改进
- 独立分析和解决复杂技术问题,推动前沿技术落地
任职要求
- 计算机科学、人工智能、电子工程等相关专业,本科及以上学历
- 扎实的系统基础,熟悉Linux环境,理解操作系统、网络与分布式系统核心原理
- 精通Python,熟悉C/C++或Go中至少一门;有良好的代码品味和工程习惯
- 熟悉PyTorch等深度学习框架,了解大模型训练与推理的基本流程
- 基础设施类岗位要求熟悉大规模分布式系统、云原生/K8s和网络
- 了解CUDA/GPU编程、性能优化或分布式训练加速技术(如Megatron、DeepSpeed、vLLM等)者优先
- 强自驱力,能独立分析和解决复杂技术问题,具备良好的沟通协作能力
福利待遇
- 薪资范围:70-100K·16薪
- 参与前沿大模型技术研发
- 与优秀团队合作,共同推动行业创新
- 支持实习和社招,灵活的职业发展路径
工作地址
北京海淀区大恒科技大厦南座F9层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。