多模态与视频生成大模型基础设施工程师
岗位摘要
深度参与生数多模态和视频生成大模型的基础设施建设;负责大规模集群中训练/推理的性能优化,整体系统稳定性、易用性、可运维能力和可观测能力的建设;与算法、工程、产品团队深度协作,针对业务场景进行联合优化
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 深度参与生数多模态和视频生成大模型的基础设施建设
- 负责大规模集群中训练/推理的性能优化,整体系统稳定性、易用性、可运维能力和可观测能力的建设
- 与算法、工程、产品团队深度协作,针对业务场景进行联合优化
任职要求
- 扎实的深度学习理论基础,深入理解各类深度学习模型结构及其训练推理特性,对性能优化有敏锐直觉,对精度对齐有sense,具备大模型infra系统级优化能力
- 熟练Python/C++编程,既能够从微观层面编写高效kernel,又可从系统层面设计框架架构,具备出色的工程实践能力和代码质量把控能力
- 熟悉pytorch源码, 分布式基本特性
- 熟悉Triton, Tilelang, cutlass等GPU算子编程框架
- 熟悉nvidia最新GPU特性(tma, cluster cta, tcgen05)
- 熟练使用agent, 从第一性原理出发解决问题
- 有代码洁癖者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。