IBM 正式发布 Granite 4.2 系列密集推理模型,包含3B、8B和旗舰30B参数版本。这是其首个原生具备 Chain-of-Thought(CoT)思考能力的系列,支持完整思考、低开销思考和关闭思考三种模式,可按查询灵活切换。模型原生支持工具调用(Tool Calling)、128K 上下文(30B 可扩展至 512K),并针对企业级Agentic AI工作流进行了优化。特别在数学推理(AIME25 达 89.17)、编码代理(SWE-Bench Verified 达 57.0)和工具使用(BFCL v4 达 61.39)等基准上表现强劲。
同期,高性能推理框架 SGLang 宣布实现 Day-0 支持,用户可立即通过 SGLang 部署并运行这些模型,进一步加速开源基础设施对新推理模型的适配。
Granite 4.2 最大的亮点,不在于参数规模有多大,而在于它把“思考”真正内置进了模型架构和训练流程里。原生 CoT + 可切换思考模式,企业用户不用再额外堆复杂的 prompt 工程或外部代理框架,就能让模型在复杂数学、多步编码、工具调用场景中先规划、再执行、还能自我纠正。这种设计对真正落地的 Agentic AI 至关重要——企业工作流往往不是简单问答,而是需要模型在真实环境中调用工具、操作终端、处理代码仓库的多步骤任务。
