全模态大模型算法工程师-长视频理解方向
岗位摘要
负责MiniCPM-o在长视频、长音频视频上下文、长文本场景下的模型训练与效果优化;建设长上下文训练数据链路,完成长视频训练数据处理与稳定训练;参与长上下文全模态模型训练策略设计,包括数据配比与长序列稳定训练优化
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责MiniCPM-o在长视频、长音频视频上下文、长文本场景下的模型训练与效果优化
- 建设长上下文训练数据链路,完成长视频训练数据处理与稳定训练
- 参与长上下文全模态模型训练策略设计,包括数据配比与长序列稳定训练优化
- 针对长视频问答、多轮历史上下文等任务,设计训练实验方案与评测分析方案
任职要求
- 具备长视频理解、长文本建模、长上下文LLM及多模态长序列训练相关经验
- 熟悉Transformer长序列训练中的常见问题,包括位置编码、KV cache、linear attention及显存优化等
- 熟悉PyTorch/Transformers,具备大模型SFT或预训练经验
- 能够独立进行多卡训练实验,包括配置训练任务、分析bad case与模型评测
- 具备扎实的算法分析能力和工程实现能力,能在复杂训练系统中定位数据、模型、训练问题
福利待遇
- 具有竞争力的薪酬待遇,50-80K·15薪
- 扁平化团队管理,工作氛围开放自由
- 参与前沿全模态大模型技术研发,成长空间大
工作地址
北京海淀区科建大厦面壁智能
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。