HaiAI123

全球AI工具精选导航

热点事件
0
热度指数
新上榜

GLM-5.3 与 Claude Mythos 在漏洞利用测试中取得突破

2026/09/30 — 10/03 01:12·2 个来源·2 篇报道

事件概览

2026 年 9 月 30 日,Simon Willison 报道了 Anthropic Frontier Red Team 的一项测试结果:该团队从内部 Binary Exploitation 基准中随机抽取 100 项任务,对多个模型进行评估,发现 GLM-5.3 在 4% 的测试中实现了完整的控制流劫持,Claude Mythos Preview 的比例为 6%。报道同时指出,GLM-5.3 在这一点上低于 Claude Mythos Preview,但一个明显的门槛已经被跨过:此前的模型,例如 Claude Opus 4.6 和 GLM-5.2,都没有成功。

同日晚些时候,开源中国报道称,Anthropic 前沿红队在评估智谱的 GLM-5.3 后认为,它是第一个能像五个月前的 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎没有拒绝护栏就放出来的模型。报道提到,五个月前 Anthropic 发布 Claude Mythos Preview 时,曾自称这是第一个能自主构建复杂端到端漏洞利用的 AI 模型。

目前事情停在 Anthropic 前沿红队给出上述评估结论这一步:两篇报道分别给出了 4% 与 6% 的测试数字,以及护栏缺失的判断,侧重点不同。材料中没有出现智谱方面的回应,也没有说明红队评估之后会有什么后续动作。

AI 综合 2 篇报道生成 · 更新于 1 小时前

最新进展Anthropic 前沿红队评估智谱 GLM-5.3 后认为,它是首个能像五个月前的 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎没有拒绝护栏就放出来的模型。五个月前 Anthropic 发布 Mythos Preview 时,曾称其为首个具备该能力的模型。

相关工具

这件事的报道 点标题看原文

9月30日
  1. Anthropic 前沿红队评估智谱 GLM-5.3 后认为,它是首个能像五个月前的 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎没有拒绝护栏就放出来的模型。五个月前 Anthropic 发布 Mythos Preview 时,曾称其为首个具备该能力的模型。

    了解开源模型能力与安全护栏的真实差距。

    开源中国AI 评分 82
  2. Anthropic Frontier Red Team 测试显示,GLM-5.3 在 4%的测试中实现完整控制流劫持,Claude Mythos Preview 为 6%,而此前模型如 Claude Opus 4.6 和 GLM-5.2 均未成功。

    揭示 AI 模型在网络安全能力上的实质性跨越

    Simon WillisonAI 评分 85

同时在说的其他事

热度怎么算的?了解口径

热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。

本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加

回热点事件榜 →