产业 / 媒体
IBM 发布 Granite 4.2 开放权重系列模型,原生支持智能体能力
IBM 正式发布 Granite 4.2 语言模型系列,提供 3B、8B 和 30B 三种参数规模。三款模型均从零开始训练,使用约 15 万亿 token 的数据,支持最长 512,000 token 的上下文窗口。模型可在「思考」与「非思考」两种模式间切换,以灵活控制不同任务的算力消耗,并提供「低消耗」模式以节省简单查询的资源开销。其中 8B 和 30B 版本经过 IBM 自研的「智能体强化学习」训练,能够在真实沙盒环境中自主学习工具调用、代码编写与执行以及网络搜索等能力。此外,IBM 同步推出 Granite Speech 5.0 Turbo CTC 语音模型,仅 4.7 亿参数却能以每秒转录三小时音频的速度领跑 Open ASR 排行榜。所有模型均以 Apache 2.0 协议开源,可在 Hugging Face、Ollama、GitHub 等平台获取。
IBM 于 2026 年 8 月 26 日正式推出 Granite 4.2 语言模型系列,涵盖 3B、8B 和 30B 三种参数规模。这批模型均从零开始训练,使用约 15 万亿 token 的高质量数据,上下文窗口最长可达 512,000 token,在长文档处理和复杂推理任务上具备显著优势。
在推理模式设计上,Granite 4.2 支持「思考」与「非思考」两种模式的灵活切换,用户可根据任务复杂程度自主调配算力资源。针对日常简单查询,模型还提供专属的「低消耗」模式,在保证输出质量的同时大幅降低计算开销,兼顾性能与效率。
智能体能力是 Granite 4.2 的核心亮点。8B 和 30B 两款较大规模的模型经过 IBM 自研「智能体强化学习」流程的专项训练,能够在真实沙盒环境中自主掌握工具调用、代码编写与执行、网络搜索等复杂技能。基准测试结果显示,30B 模型在所有智能体任务和工具使用测试中均位居榜首。所有模型均原生支持 OpenAI 格式的工具调用接口,并可在 vLLM 或 SGLang 推理框架上直接部署。
在语音处理领域,IBM 同步发布了 Granite Speech 5.0 Turbo CTC 系列模型。该系列仅有 4.7 亿参数,却能以每秒转录三小时音频的速度运行,速度是此前 Open ASR 排行榜领先者的两倍。轻量化的参数规模使其在边缘设备和资源受限场景下同样具备实用价值。
在开放策略方面,Granite 4.2 全系采用 Apache 2.0 协议发布,用户可在 Hugging Face、Ollama、GitHub 等主流平台免费获取并商业使用,无需额外授权。这一开放姿态延续了 IBM 在企业级 AI 领域推动开源生态的一贯策略,也为开发者和企业提供了更低门槛的落地路径。
要点
- Granite 4.2 提供 3B、8B、30B 三种规格,均基于约 15 万亿 token 从零训练,最长支持 512K token 上下文。
- 8B 和 30B 模型经过「智能体强化学习」训练,可在真实沙盒中自主学习工具调用、代码执行和网络搜索,30B 在智能体基准测试中全面领先。
- 模型支持「思考/非思考」双模式切换及低消耗模式,可按任务需求灵活调配算力。
- 配套发布的 Granite Speech 5.0 Turbo CTC 仅 4.7 亿参数,转录速度是前代领先者的两倍,每秒可处理三小时音频。
- 全系模型以 Apache 2.0 协议开源,支持 vLLM、SGLang 部署及 OpenAI 格式工具调用,可在多个主流平台直接获取。
原始标题:IBM drops open-weight Granite 4.2 family with built-in agentic capabilities under Apache 2.0
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。