GLM-5.3 领跑开源模型,但权重发布延期
The Decoder··作者 Maximilian Schreiner
关键信息
GLM-5.3 最大的提升来自智能体任务:它在 GDPval-AA v2 上的 Elo 从 1524 升到 1770,仅次于 Claude Opus 5 的 1855。Artificial Analysis 估算它的单任务成本为 0.68 美元,比 Kimi K3 的 0.84 美元便宜 19%,但高于 GLM-5.2 的 0.44 美元。
资讯摘要
GLM-5.3 是中国创业公司 Z.ai 的最新模型,并且已经在 Artificial Analysis 的 Intelligence Index 上冲到开源模型前列。该模型得分为 60,与 Kimi K3 并列开源模型第一,同时比 GLM-5.2 高出 7 分。它最显著的提升出现在智能体任务上,在 GDPval-AA v2 基准上的 Elo 分数从 1524 跃升到 1770,增加了 246 分。这个成绩让它在该榜单上排到第二名,只落后于 Claude Opus 5 的 1855 分。
Artificial Analysis 还估算,GLM-5.3 的单任务成本为 0.68 美元。这个价格是 GLM-5.2 的 1.5 倍,但仍比 Kimi K3 的 0.84 美元便宜 19%。目前,GLM-5.3 已经可以通过 Z.ai 的 API 使用。与此同时,Z.ai 表示开源权重不会立刻发布,而是要延迟大约两周,因为公司认为该模型在检测安全漏洞方面过于有效,需要先加强控制,并只向少数安全合作伙伴开放完整访问权限。

资讯正文
GLM-5.3 登顶开源模型排行榜,并以更低价格压过竞品,但其发布被推迟
来自中国初创公司 Z.ai 的 AI 模型 GLM-5.3 在 Artificial Analysis Intelligence Index 上获得 60 分。该成绩使它与 Kimi K3 并列开源模型第一名,同时比上一代 GLM-5.2 高出 7 分。
该模型可通过 Z.ai 的 API 使用。不过,Z.ai 正将开源权重的发布推迟约两周,因为据公司称,GLM-5.3 在检测安全漏洞方面效果过于出色,因此公司正先加强控制措施,并将完整访问权限限制给部分安全合作伙伴。
来源与参考
收录于 2026-08-20