Doyensec:AI 渗透测试 Agent 一致性存疑
2026/10/03 — 10/03 01:50·1 个来源·1 篇报道
事件概览
安全公司 Doyensec 的一项研究为 AI 渗透测试 Agent 的实际能力提供了一份证据。据 DEV Community 在 2026 年 10 月 3 日刊出的报道,这项研究于今年 5 月进行,结论是:面对 73 个漏洞,两个 AI 渗透测试代理只有 7 个给出了相同的判断。
报道提到,渗透测试报告在实际商业场景中往往是被动触发的需求。如果你把软件卖给任何设有安全团队的客户,SOC 2 审计方、采购问卷、保险续保流程迟早会索要一份渗透测试报告。常见的应对方式是聘请咨询公司,对应用测试一次、输出一份 PDF,而等到下一次部署时,这份报告已经过时。AI 渗透测试 Agent 正是以持续运行这类测试为卖点,报道称,到 2026 年,关于这类工具实际表现的证据终于开始出现。
Doyensec 给出的 73 个漏洞中仅 7 个判断一致这一数字,被报道用来说明这类工具在可靠性上仍存在明显缺口。除此之外,现有材料没有给出研究的更多细节,也没有说明两个代理的具体名称、其背后的模型或测试方法。
AI 综合 1 篇报道生成 · 更新于 1 小时前
最新进展安全公司 Doyensec 今年 5 月的一项研究给 AI 渗透测试 Agent 的实际能力提供了证据:在 73 个漏洞中,两个 AI 测试代理只有 7 个判断一致。这类工具主打持续运行、替代一次性咨询报告,但这一致性数据说明可靠性仍有明显缺口。

这件事的报道 点标题看原文
安全公司 Doyensec 今年 5 月的一项研究给 AI 渗透测试 Agent 的实际能力提供了证据:在 73 个漏洞中,两个 AI 测试代理只有 7 个判断一致。这类工具主打持续运行、替代一次性咨询报告,但这一致性数据说明可靠性仍有明显缺口。
看 AI 安全测试工具真实水平的一个硬数据。
DEV Community · AIAI 评分 78
同时在说的其他事
- 625爆英伟达发布 64GB 版 DGX Spark,售价 4999 美元7 个来源
- 495发酵中谷歌发布 Gemini 4 Argon 模型,定位前沿 AI 能力14 个来源
- 389新Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险4 个来源
- 224爆微软发布 MAI-Transcribe-2-Streaming 实时转写模型3 个来源
- 191新Anthropic 投 1 亿美元启动 Claude 工程师学院2 个来源
- 179新Hugging Face 开源报告生成模型 AstaBrief2 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
