Helix AI工程师,视频预训练
岗位摘要
设计和训练大规模视频基础模型,使用涵盖互联网规模视频和机器人收集数据的多样化数据集;开发能够从原始视频序列中捕捉时间动态、运动和物体交互的预训练策略;构建能够为感知、跟踪、预测和控制等下游任务学习可迁移表示的模型
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计和训练大规模视频基础模型,使用涵盖互联网规模视频和机器人收集数据的多样化数据集
- 开发能够从原始视频序列中捕捉时间动态、运动和物体交互的预训练策略
- 构建能够为感知、跟踪、预测和控制等下游任务学习可迁移表示的模型
- 探索用于视频理解和生成的架构,包括基于Transformer和基于扩散的方法
- 实现高效的数据管道和训练策略,用于高吞吐量视频摄入和大规模分布式训练
- 在计算、内存和训练效率约束下优化模型性能
- 与生成建模、智能体和机器人学习团队紧密合作,将预训练模型集成到自主技术栈中
- 设计评估框架和基准,以衡量时间理解、预测质量和泛化能力
任职要求
- 具有在视频数据或其他高维序列模态上训练大规模模型的经验
- 对视频、视觉或多模态系统的现代深度学习架构有深入理解
- 具有大规模预训练经验,包括数据集整理、训练动态和缩放定律
- 熟练掌握Python和深度学习框架,如PyTorch
- 具有分布式训练系统和大规模GPU集群的工作经验
- 具备严格的实验能力,能够快速迭代模型设计和训练策略
- 扎实的软件工程技能,能够构建可扩展、可靠的系统
- 能够独立工作并推动模糊、高影响力的研究方向
福利待遇
- 美国基本薪资范围:200,000 - 400,000美元(全职职位)
- 薪资可能根据个人因素(如与工作相关的知识、技能和经验)有所差异
- 总薪酬方案可能包括根据具体角色而定的额外组成部分/福利
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。