返回岗位列表

Figure AI

Helix AI工程师,视频预训练

地点:美国 薪资:$200,000-$400,000 日期:2026-07-20

岗位摘要

设计和训练大规模视频基础模型,使用涵盖互联网规模视频和机器人收集数据的多样化数据集;开发能够从原始视频序列中捕捉时间动态、运动和物体交互的预训练策略;构建能够为感知、跟踪、预测和控制等下游任务学习可迁移表示的模型

岗位职责

  • 设计和训练大规模视频基础模型,使用涵盖互联网规模视频和机器人收集数据的多样化数据集
  • 开发能够从原始视频序列中捕捉时间动态、运动和物体交互的预训练策略
  • 构建能够为感知、跟踪、预测和控制等下游任务学习可迁移表示的模型
  • 探索用于视频理解和生成的架构,包括基于Transformer和基于扩散的方法
  • 实现高效的数据管道和训练策略,用于高吞吐量视频摄入和大规模分布式训练
  • 在计算、内存和训练效率约束下优化模型性能
  • 与生成建模、智能体和机器人学习团队紧密合作,将预训练模型集成到自主技术栈中
  • 设计评估框架和基准,以衡量时间理解、预测质量和泛化能力

任职要求

  • 具有在视频数据或其他高维序列模态上训练大规模模型的经验
  • 对视频、视觉或多模态系统的现代深度学习架构有深入理解
  • 具有大规模预训练经验,包括数据集整理、训练动态和缩放定律
  • 熟练掌握Python和深度学习框架,如PyTorch
  • 具有分布式训练系统和大规模GPU集群的工作经验
  • 具备严格的实验能力,能够快速迭代模型设计和训练策略
  • 扎实的软件工程技能,能够构建可扩展、可靠的系统
  • 能够独立工作并推动模糊、高影响力的研究方向

福利待遇

  • 美国基本薪资范围:200,000 - 400,000美元(全职职位)
  • 薪资可能根据个人因素(如与工作相关的知识、技能和经验)有所差异
  • 总薪酬方案可能包括根据具体角色而定的额外组成部分/福利