GLM-5.3 与 Claude Mythos 在漏洞利用测试中取得突破
2026/09/30 — 10/03 01:12·2 个来源·2 篇报道
事件概览
2026 年 9 月 30 日,Simon Willison 报道了 Anthropic Frontier Red Team 的一项测试结果:该团队从内部 Binary Exploitation 基准中随机抽取 100 项任务,对多个模型进行评估,发现 GLM-5.3 在 4% 的测试中实现了完整的控制流劫持,Claude Mythos Preview 的比例为 6%。报道同时指出,GLM-5.3 在这一点上低于 Claude Mythos Preview,但一个明显的门槛已经被跨过:此前的模型,例如 Claude Opus 4.6 和 GLM-5.2,都没有成功。
同日晚些时候,开源中国报道称,Anthropic 前沿红队在评估智谱的 GLM-5.3 后认为,它是第一个能像五个月前的 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎没有拒绝护栏就放出来的模型。报道提到,五个月前 Anthropic 发布 Claude Mythos Preview 时,曾自称这是第一个能自主构建复杂端到端漏洞利用的 AI 模型。
目前事情停在 Anthropic 前沿红队给出上述评估结论这一步:两篇报道分别给出了 4% 与 6% 的测试数字,以及护栏缺失的判断,侧重点不同。材料中没有出现智谱方面的回应,也没有说明红队评估之后会有什么后续动作。
AI 综合 2 篇报道生成 · 更新于 1 小时前
最新进展Anthropic 前沿红队评估智谱 GLM-5.3 后认为,它是首个能像五个月前的 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎没有拒绝护栏就放出来的模型。五个月前 Anthropic 发布 Mythos Preview 时,曾称其为首个具备该能力的模型。
这件事的报道 点标题看原文
Anthropic 前沿红队评估智谱 GLM-5.3 后认为,它是首个能像五个月前的 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎没有拒绝护栏就放出来的模型。五个月前 Anthropic 发布 Mythos Preview 时,曾称其为首个具备该能力的模型。
了解开源模型能力与安全护栏的真实差距。
Anthropic Frontier Red Team 测试显示,GLM-5.3 在 4%的测试中实现完整控制流劫持,Claude Mythos Preview 为 6%,而此前模型如 Claude Opus 4.6 和 GLM-5.2 均未成功。
揭示 AI 模型在网络安全能力上的实质性跨越
同时在说的其他事
- 545新英伟达发布 64GB 版 DGX Spark,售价 4999 美元6 个来源
- 508发酵中谷歌发布 Gemini 4 Argon 模型,定位前沿 AI 能力14 个来源
- 230爆微软发布 MAI-Transcribe-2-Streaming 实时转写模型3 个来源
- 196新Anthropic 投 1 亿美元启动 Claude 工程师学院2 个来源
- 183新Hugging Face 开源报告生成模型 AstaBrief2 个来源
- 178发酵中OpenAI DevDay 2026 发布 Dots、Decisions API 等新品2 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
