IBM开源Granite 4.2:推理大升级,但把Mamba撤了

2026-08-27 41 次阅读 RSS订阅
动察 Beating AI 快讯,IBM 开源新一代语言模型 Granite 4.2,分 3B、8B 和 30B 三档。三款都加入原生推理,可以在完整思考、低强度思考和不思考之间切换,也能直接调用工具。 8B 和 30B 还专门做了 Agent 强化学习,在真实代码仓库、终端和网页搜索环境里执行任务。训练奖励直接看任务结果,比如代码能不能通过测试、终端任务有没有完成。三款模型都采用 Apache 2.0 许可。 独立评测里,小模型反而很亮眼。Artificial Analysis 给 3B 版 14 分,在 46 个同量级开放权重模型中排第 2;8B 版得 20 分,也明显高于同量级中位数 9。IBM 自测中,30B 的 SWE-Bench Verified 为 57%,AIME25 为 89.17%。 架构上则来了个反转。Granite 4.0 当初主打 Mamba-2/Transformer 混合架构,IBM 称长上下文和多并发场景下可降低 70% 以上内存需求;Granite 4.2 却重新换成纯 Dense Transformer。相比上一代追求推理效率,这一代明显把重点转向了推理和 Agent 能力。

📰 来源:https://www.okx.com/zh-hans/feed/post/85766867190976

💬 引用锚点
Granite 4.2引入原生推理能力,支持在完整思考、低强度思考和不思考模式间灵活切换,满足多样化任务需求。
8B和30B版本专门强化Agent能力,通过真实代码仓库和终端环境进行强化学习,直接以任务完成结果作为训练奖励。
相比4.0代的Mamba-2混合架构,4.2转而采用纯Dense Transformer,标志着发展重心从推理效率转向推理和Agent能力。

常见问题

IBM Granite 4.2 提供了哪些模型规模?▼
Granite 4.2 在架构上有什么重大变化?▼
8B 和 30B 版本的训练方式有何特点?▼
Granite 4.2 的主要优势是什么?▼