已核验 · Aug 29, 2026
智谱兑现两周承诺:GLM-5.3 权重上架 Hugging Face —— 发布帖同时披露攻击链能力翻倍
2 个信源Z.ai 的 GLM-5.3 发布帖(2026-08-14)写明:「发布两周后,完成安全评估与加固即放出权重」。承诺兑现:Hugging Face 的 zai-org 组织页现在列出 zai-org/GLM-5.3 与 zai-org/GLM-5.3-BF16(仓库元数据约 753B 参数),最后更新 2026-08-28;更小的 GLM-5.3-Flash(约 321B)于 2026-08-27 上线。Z.ai 说明 GLM-5.3 与 GLM-5.2 共用基座,增益全部来自后训练,并宣称在自家的 Z.ai Code Bench 上较 GLM-5.2 提升 50%。同一篇帖子还有「Emergent Cyber Capability」章节:攻击链表现较 GLM-5.2 翻倍以上(ExploitBench 54.4 对 24.4),自报 CyberGym 84.5 的 SOTA,并提到一个在 269 个开源项目中发现 2,436 个漏洞的真实项目 —— 全部记录在 Z.ai 公开的 Security Disclosure Ledger 里。
为什么现在讲
这周有两件事同时在线:权重本身(2026-08-28 更新,可在 zai-org 组织页直接核对)和大部分发布报道略过的治理故事 —— 厂商把攻击向能力数字连同披露账本一起发了出来。组织页还列出了托管服务商,创作者可以直接指出模型实际在哪里跑,不用暗示观众本地部署。
推荐理由
「承诺 → 兑现」可以在屏幕上当场验证(先给引文,再切仓库记录),而网络攻击能力披露是信任与治理故事,不是参数更新 —— 和这周其他开源权重报道形成差异。保留意见密度高:基准是厂商自测,所以这张卡自带明确的归属类风险提示。
依据
HF zai-org 模型索引(权重 2026-08-28 最后更新)+ Z.ai 发布帖(依页面内证据定为 2026-08-14)。
“智谱说两周后放权重,真的一天没拖 —— 同时它自己承认,这代模型搞攻击链比上一代翻了一倍多。”
切入角度
一张卡里两条线:开源权重承诺如期兑现;厂商主动承认自己的开放模型在攻击链上明显变强。第二条按「披露与治理」来讲 —— 绝对不做成技术演示。
形式
长视频讲解
演示想法
同屏录 zai-org 组织页和发布帖:先给「两周后放权重」的引文,再切到 2026-08-28 的权重更新记录。然后打开 Security Disclosure Ledger,抛出治理问题 —— 开源权重发布是不是该配一份这样的能力披露?所有基准数字都标注「Z.ai 自测」。
平台注意
每个能力数字都归属到 Z.ai 发布帖,并标明基准为厂商自测。不要展示或描述漏洞利用技术、提示词或目标 —— 这是安全披露故事,不是教学。提醒观众下载前先到模型页确认许可证(抓取时未验证)。
可用说法
- GLM-5.3 的完整权重已上架 Hugging Face 的 zai-org 组织页:zai-org/GLM-5.3 与 zai-org/GLM-5.3-BF16(仓库元数据约 753B 参数)最后更新于 2026-08-28,更小的 GLM-5.3-Flash(约 321B)于 2026-08-27 上线。这兑现了 Z.ai 发布帖中的承诺 ——「发布两周后,完成安全评估与加固即放出权重」。Z.ai 说明 GLM-5.3 与 GLM-5.2 共用基座模型,增益全部来自后训练。
- Z.ai 发布帖宣称 GLM-5.3 是「最强开源权重编程模型,在自家的 Z.ai Code Bench 上较 GLM-5.2 提升 50%」,并报告其在自测的智能体编程基准套件上领先所有开源权重模型。所有数字均为厂商自测结果,未引用任何独立复现。
- Z.ai 发布帖设有「Emergent Cyber Capability」章节:自报攻击链全程表现较 GLM-5.2 翻倍以上(ExploitBench 54.4 对 24.4)、CyberGym 漏洞发现 84.5 的 SOTA、ExploitGym 两小时预算内完成 105 个任务(六小时预算内 130 个)。同一帖中,Z.ai 还报告与中国安全团队的合作在 269 个开源项目中发现 2,436 个漏洞 —— 其中 1,097 个为中高危,最早的引入约在 1981 年(约 40 年前)—— 全部记录在 Z.ai 公开的 Security Disclosure Ledger 中。
证据链
拆解
Z.ai 在 2026-08-14 的发布帖里承诺权重「发布两周后,完成安全评估与加固即放出」;zai-org 的 Hugging Face 组织页显示 GLM-5.3 与 GLM-5.3-BF16(约 753B)于 2026-08-28 更新 —— 承诺兑现,而且可当场核对。本文接着走大部分报道略过的第二层:帖子自己的「Emergent Cyber Capability」披露(ExploitBench 54.4 对 24.4、CyberGym 84.5)与 2,436 个漏洞的 Security Disclosure Ledger,并划清「报道一份披露」和「复述一次漏洞利用」的界线。基准数字全程归属 Z.ai 并标注为自测;许可证条款在抓取时未能验证。
信源
风险
- 按「安全披露」来讲:每个能力数字都归属到 Z.ai 发布帖,基准标注为厂商自测,不复述漏洞细节、提示词或目标清单。创作者的角度是治理问题 —— 开源权重加上攻击向能力该怎么披露 —— 而不是技术本身。
- 如果要演示自托管,先把完整模型需要的硬件量级说清楚,镜头上的运行请走托管端点。让观众下载任何东西之前,先到模型页确认许可证和量化版本。
演示思路
- 承诺与兑现的分屏:发布帖引文(「两周后放权重」)对照 zai-org 组织页 2026-08-28 的更新记录
- 治理讲解:ExploitBench 翻倍(54.4 对 24.4)与 2,436 个漏洞的账本,框架是「开源权重的披露可以长什么样」—— 屏幕上不出现任何漏洞利用内容