Ling 3.0 Flash 成为同尺寸最强开源模型

The Decoder··作者 Manuel Uth

关键信息

文章称,Ling 3.0 Flash 仍落后于同一指数上得分 52 的 DeepSeek V4 Flash,但它被认为是总参数少于 1240 亿的最强开源模型。在 AA Omniscience 测试中,它的幻觉率据称从 97% 降到 44%,并且在 t3-Bench Banking 等智能体任务上也有提升,不过在复杂任务中可能比一些竞品消耗更多 token。

资讯摘要

文章将 Ling 3.0 Flash 描述为其前代版本的重大升级,并称其为同尺寸级别中最聪明的开源模型。它在 Artificial Analysis Intelligence Index 上得分 38 分,文中强调这相较前代有明显提升,并且尽管使用更少的激活参数,表现却大致与 Qwen3.6 27B 相当。该模型仍然落后于得分 52 分的 DeepSeek V4 Flash,但 Artificial Analysis 认为,它是总参数少于 1240 亿的最强开源模型。文中还指出,没有更小的模型能够达到它的分数,因此它在自己的类别中处于领先位置。文章特别强调了幻觉问题的大幅改善:在 AA Omniscience 测试中,幻觉率据称从 97% 降到了 44%。

这意味着模型更倾向于在没有可靠答案时拒绝回答,而不是编造内容。除了事实可靠性之外,Ling 3.0 Flash 在智能体任务上的表现也被描述为有所提升,包括 t3-Bench Banking。价格方面,文章称它在按 token 计费时优于所有能力相当的模型,即使在复杂任务中会消耗比一些竞品更多的 token,按单个任务计算仍比 Qwen3.6 27B 更便宜。蚂蚁集团旗下的 inclusionAI 正通过其 API 和 DeepInfra 发布该模型,模型权重也已在 Hugging Face 上开放。

Ling 3.0 Flash 成为同尺寸最强开源模型

资讯正文

Ling 3.0 Flash 是同尺寸中最聪明的开放模型

Ling 3.0 Flash 是同规模类别里最聪明的开放模型。在 Artificial Analysis Intelligence Index 上,Ling 3.0 Flash 得分 38 分,相比前代有大幅提升。这使它在使用少得多的活动参数时,性能已经与 Qwen3.6 27B 相当。它仍然落后于领跑者 DeepSeek V4 Flash,后者得分为 52 分。根据 Artificial Analysis 的说法,它是总参数量低于 1240 亿的开放模型中最聪明的一个。没有更小的模型能匹配它的得分。

在 AA Omniscience 测试中,与上一版本相比,幻觉率从 97% 降至 44%。现在,这个模型在没有可靠答案时拒绝作答的频率要高得多。Ling 3.0 Flash 在智能体任务上的表现也较前代有明显提升,包括在 t3-Bench Banking 基准上的表现。

在按 token 计价方面,Ling 3.0 Flash 优于所有能力相近的模型。不过,在复杂任务上,它消耗的 token 也比同样强大的替代方案更多。但即便按单个任务计算,它的成本仍低于 Qwen3.6 27B。蚂蚁集团的 inclusionAI 正在通过 inclusionAI API 以及 DeepInfra 以 MIT 许可证发布该模型。模型权重可直接在 Hugging Face 上获取。

来源与参考

  1. 原始链接
  2. Ling 3.0 Flash is the smartest open model at its size

收录于 2026-08-14