IBM 发布更新版 Granite 本地模型

Ars Technica AI··作者 Samuel Axon

关键信息

IBM 表示这条产品线仍采用仅解码器架构,也就是模型主要依靠 Transformer 的解码部分,基于输入上下文生成文本。3B 版本同样支持工具调用,但没有像 8B 和 30B 版本那样接受同等级别的智能体专门训练。

资讯摘要

IBM 发布了 Granite 4.2,这是其最新一代可下载并自托管的开源权重大语言模型。新系列包含 3B、8B 和 30B 三种参数规模。和之前的 Granite 版本一样,这些模型采用仅解码器架构。整条产品线的一个重要共同点是原生支持 128,000 token 的上下文窗口。这样一来,模型在处理长提示词、长对话或较大段检索文本时,能够保留更多可用上下文。

IBM 还表示,8B 和 30B 版本加入了智能体强化学习训练模块。这样的训练旨在提升模型使用终端、搜索网页和调用外部工具等能力。较小的 3B 模型也支持工具,但没有接受同等程度的专门训练。总体来看,这次发布主要面向希望在本地推理环境中获得更大灵活性的用户。

IBM 发布更新版 Granite 本地模型

资讯正文

IBM 已经推出了其开放权重大语言模型系列中的最新模型,这些模型旨在下载后自行托管。新发布的 Granite 4.2 提供 3B、8B 和 30B 三种参数版本。

与之前的版本一样,IBM 这里采用的是仅解码器(decoder-only)方案。这些新版本原生提供 128,000 token 的上下文窗口。8B 和 30B 版本(但不包括 3B 版本)还经过了 agentic 强化学习模块;它们接受过训练,以增强诸如使用终端、搜索网页或使用外部工具等能力。3B 模型也支持工具,但没有经过同等程度的专门训练。

来源与参考

  1. 原始链接
  2. IBM's new Granite 4.2 models ride the wave of interest in local LLMs

收录于 2026-08-27