Post-Train 训推基建优化工程师
岗位摘要
参与构建训推基建易用性,维护并持续优化 Post-Train 训推框架,降低使用门槛,让研究员专注于实验本身而非环境问题;深入训练与推理全链路,覆盖显存优化、通信加速、调度策略、吞吐与延迟等核心指标,缩短实验周期,提升资源利用率
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与构建训推基建易用性,维护并持续优化 Post-Train 训推框架,降低使用门槛,让研究员专注于实验本身而非环境问题
- 深入训练与推理全链路,覆盖显存优化、通信加速、调度策略、吞吐与延迟等核心指标,缩短实验周期,提升资源利用率
- 构建高效稳定的数据处理与供给流水线,支持多源异构数据的清洗、混合与动态调度
- 加速 Post-Train 端到端组织迭代效率,让研究员更快地跑实验、更稳地出结果、更低成本地验证想法
任职要求
- 熟悉 Post-Train 训练流程,包括 SFT、RLVR、RLHF、AgentRL 等,对训推基建有深入了解
- 有大模型系统开发和优化经验,具备从零搭建或大规模改造训推系统的实际案例
- 有独立思考能力,有自己的判断,不迷信权威,不满足于跟随做法
- 有工程项目维护经验,对质量有执念,在意系统的可观测性、可复现性及问题根因定位能力
- 对分布式训推的底层逻辑有第一手认知,能够在任意层面展开讲清楚分布式训练原理
- 高强度使用 AI 工具辅助开发、调试和分析,同时清楚 AI 的能力边界
福利待遇
- 薪资范围 35-65K,16薪
- 工作地点位于北京海淀区大恒科技大厦,交通便利
- 参与前沿大模型训推基建建设,与优秀团队共同成长
工作地址
北京海淀区大恒科技大厦12层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。