IBM开源Granite 4.2:3B小模型独立评测同级第2
发布时间:2026-08-27
动察 Beating AI 快讯,IBM 开源新一代语言模型 Granite 4.2,一共 3B、8B 和 30B 三档。三款模型都加入原生推理,可以选择完整思考、低强度思考或直接回答,也都支持工具调用。模型权重采用 Apache 2.0 许可开放。这次重点升级是 Agent。8B 和 30B 专门加入 Agent 强化学习,不只在数据集里做题,而是直接进入真实代码仓库、终端和网页搜索环境执行任务。写代码就看测试能不能通过,操作终端就看任务有没有真正完成,再根据结果给模型奖励。3B 没有经过这一阶段。小模型的独立成绩反而最亮眼。Artificial Analysis 给 Granite 4.2 3B 的 Intelligence Index 打出 14 分,在 46 款同级开放权重模型中排名第 2,同级中位数只有 4 分。8B 得到 20 分,也明显高于同级中位数 9 分。IBM 自测中,30B 在 SWE-Bench Verified 达到 57%,AIME25 为 89.17%。相比 Granite 4.1,这一代最明确的新增点不是继续堆基础能力,而是让小模型正式拥有推理,并让 8B、30B 直接在真实环境里学习怎么当 Agent。----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考----------交流群:https://t.me/dunwangyuanhuiwang

动察 Beating AI 快讯,IBM 开源新一代语言模型 Granite 4.2,一共 3B、8B 和 30B 三档。三款模型都加入原生推理,可以选择完整思考、低强度思考或直接回答,也都支持工具调用。模型权重采用 Apache 2.0 许可开放。


这次重点升级是 Agent。8B 和 30B 专门加入 Agent 强化学习,不只在数据集里做题,而是直接进入真实代码仓库、终端和网页搜索环境执行任务。写代码就看测试能不能通过,操作终端就看任务有没有真正完成,再根据结果给模型奖励。3B 没有经过这一阶段。


小模型的独立成绩反而最亮眼。Artificial Analysis 给 Granite 4.2 3B 的 Intelligence Index 打出 14 分,在 46 款同级开放权重模型中排名第 2,同级中位数只有 4 分。8B 得到 20 分,也明显高于同级中位数 9 分。


IBM 自测中,30B 在 SWE-Bench Verified 达到 57%,AIME25 为 89.17%。相比 Granite 4.1,这一代最明确的新增点不是继续堆基础能力,而是让小模型正式拥有推理,并让 8B、30B 直接在真实环境里学习怎么当 Agent。

----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考 ----------交流群:https://t.me/dunwangyuanhuiwang