HaiAI123

全球AI工具精选导航

热点事件
持平

开发者自查 AI 爬虫能否抓取网站:八种全部返回 200

2026/10/03 — 10/05 03:19·1 个来源·1 篇报道

事件概览

2026 年 9 月 30 日,一位开发者对自己的站点做了一次 AI 爬虫抓取自查:按每个爬虫的名字逐一请求页面,再读取返回的状态码,以此判断 ChatGPT、Claude、Perplexity 等背后的爬虫能否取到页面。测试一共用了八个爬虫名,八个请求全部返回 200,也就是说站点上没有设置把这些机器挡在门外。

这份自查记录在 2026 年 10 月 3 日由 DEV Community 的 AI 栏目发布,原文首发于 yappatyih.com。作者把结论放在最前面:八个爬虫名,八个 200。

同一轮检查真正发现的问题在别处:robots.txt 里有一行 Disallow: /og/,把每一页的预览图都屏蔽掉了。也就是说,这次自查没有测出爬虫被拦,但顺带查出了预览图被 robots.txt 屏蔽这一项。

AI 综合 1 篇报道生成 · 更新于 12 分钟前

最新进展有开发者用八个爬虫名(ChatGPT、Claude、Perplexity 等)逐一请求自己的站点,检查 AI 爬虫能否抓取页面,结果八个全部返回 200。同一轮检查发现的问题在别处:robots.txt 里一行 Disallow: /og/ 屏蔽了每页的预览图。

24 小时热度热度指数 31 · 峰值 61 · 23 小时前
24 小时前现在

这件事的报道 点标题看原文

10月3日
  1. 有开发者用八个爬虫名(ChatGPT、Claude、Perplexity 等)逐一请求自己的站点,检查 AI 爬虫能否抓取页面,结果八个全部返回 200。同一轮检查发现的问题在别处:robots.txt 里一行 Disallow: /og/ 屏蔽了每页的预览图。

    想弄清 AI 爬虫为何不收录你站点的,可照这个方法自查

    DEV Community · AIAI 评分 58

同时在说的其他事

热度怎么算的?了解口径

热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。

本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加

回热点事件榜 →