返回岗位列表

xAI

视觉/视频理解集成工程师

地点:美国 薪资:$180,000-$440,000 日期:2026-01-29

岗位摘要

设计并构建端到端AI解决方案,从理解客户痛点、确定产品规格到部署基于视觉语言模型的视觉界面;对视觉模型进行基准测试、编写评估报告或分析性能,以识别图像识别、目标检测或视觉理解方面的弱点

岗位职责

  • 设计并构建端到端AI解决方案,从理解客户痛点、确定产品规格到部署基于视觉语言模型的视觉界面
  • 对视觉模型进行基准测试、编写评估报告或分析性能,以识别图像识别、目标检测或视觉理解方面的弱点
  • 通过系统提示调优和微调视觉语言模型来提升模型性能
  • 与多模态团队合作,为开发工作生成数据
  • 生成合成数据或启动活动,借助AI导师的帮助生成人工数据
  • 分析视觉请求日志、图像数据或视频输入,以提升系统准确性和用户体验
  • 构建内部工具以自动化视觉语言模型工作流程,例如图像处理管道或实时视觉分析
  • 定义视觉或视频理解性能的关键基准:针对企业视觉用例(如图像分类准确性、目标检测精度和实时延迟)建立关键性能基准,反映客户数据分布
  • 启动人工数据收集:设计并管理活动,从不同的企业环境中获取高质量的图像和视频数据,以支持模型训练和验证
  • 推动视觉模型与企业合作伙伴的集成:与跨职能团队合作,将视觉能力集成到企业工作流程中,实现自动化质量控制、监控等领域的无缝采用

任职要求

  • 在视觉或视频理解模型方面具备深厚专业知识,能够交付稳健且可扩展的解决方案
  • 能够在快节奏的初创环境中处理模糊性、适应不断变化的需求并有效确定优先级
  • 具备出色的沟通技巧,能够与客户明确具体需求并推动项目成功完成
  • 强调设计、实施和维护高效架构,包括图像识别、目标检测和实时视觉处理
  • 精通管理复杂代码库,并优化视觉数据管道以实现高吞吐量、低延迟的性能