视觉/视频理解集成工程师
岗位摘要
设计并构建端到端AI解决方案,从理解客户痛点、确定产品规格到部署基于视觉语言模型的视觉界面;对视觉模型进行基准测试、编写评估报告或分析性能,以识别图像识别、目标检测或视觉理解方面的弱点
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计并构建端到端AI解决方案,从理解客户痛点、确定产品规格到部署基于视觉语言模型的视觉界面
- 对视觉模型进行基准测试、编写评估报告或分析性能,以识别图像识别、目标检测或视觉理解方面的弱点
- 通过系统提示调优和微调视觉语言模型来提升模型性能
- 与多模态团队合作,为开发工作生成数据
- 生成合成数据或启动活动,借助AI导师的帮助生成人工数据
- 分析视觉请求日志、图像数据或视频输入,以提升系统准确性和用户体验
- 构建内部工具以自动化视觉语言模型工作流程,例如图像处理管道或实时视觉分析
- 定义视觉或视频理解性能的关键基准:针对企业视觉用例(如图像分类准确性、目标检测精度和实时延迟)建立关键性能基准,反映客户数据分布
- 启动人工数据收集:设计并管理活动,从不同的企业环境中获取高质量的图像和视频数据,以支持模型训练和验证
- 推动视觉模型与企业合作伙伴的集成:与跨职能团队合作,将视觉能力集成到企业工作流程中,实现自动化质量控制、监控等领域的无缝采用
任职要求
- 在视觉或视频理解模型方面具备深厚专业知识,能够交付稳健且可扩展的解决方案
- 能够在快节奏的初创环境中处理模糊性、适应不断变化的需求并有效确定优先级
- 具备出色的沟通技巧,能够与客户明确具体需求并推动项目成功完成
- 强调设计、实施和维护高效架构,包括图像识别、目标检测和实时视觉处理
- 精通管理复杂代码库,并优化视觉数据管道以实现高吞吐量、低延迟的性能
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。