IBM开源Granite 4.2:推理大升级,但把Mamba撤了
动察 Beating AI 快讯,IBM 开源新一代语言模型 Granite 4.2,分 3B、8B 和 30B 三档。三款都加入原生推理,可以在完整思考、低强度思考和不思考之间切换,也能直接调用工具。
8B 和 30B 还专门做了 Agent 强化学习,在真实代码仓库、终端和网页搜索环境里执行任务。训练奖励直接看任务结果,比如代码能不能通过测试、终端任务有没有完成。三款模型都采用 Apache 2.0 许可。
独立评测里,小模型反而很亮眼。Artificial Analysis 给 3B 版 14 分,在 46 个同量级开放权重模型中排第 2;8B 版得 20 分,也明显高于同量级中位数 9。IBM 自测中,30B 的 SWE-Bench Verified 为 57%,AIME25 为 89.17%。
架构上则来了个反转。Granite 4.0 当初主打 Mamba-2/Transformer 混合架构,IBM 称长上下文和多并发场景下可降低 70% 以上内存需求;Granite 4.2 却重新换成纯 Dense Transformer。相比上一代追求推理效率,这一代明显把重点转向了推理和 Agent 能力。
💬 引用锚点
Granite 4.2引入原生推理能力,支持在完整思考、低强度思考和不思考模式间灵活切换,满足多样化任务需求。
8B和30B版本专门强化Agent能力,通过真实代码仓库和终端环境进行强化学习,直接以任务完成结果作为训练奖励。
相比4.0代的Mamba-2混合架构,4.2转而采用纯Dense Transformer,标志着发展重心从推理效率转向推理和Agent能力。
常见问题
IBM Granite 4.2 提供了哪些模型规模?▼
Granite 4.2 在架构上有什么重大变化?▼
8B 和 30B 版本的训练方式有何特点?▼
Granite 4.2 的主要优势是什么?▼
订阅最新文章
输入邮箱,第一时间获取最新动态。
💬 评论 (0)
发表评论