开发者自查 AI 爬虫能否抓取网站:八种全部返回 200
2026/10/03 — 10/05 03:19·1 个来源·1 篇报道
事件概览
2026 年 9 月 30 日,一位开发者对自己的站点做了一次 AI 爬虫抓取自查:按每个爬虫的名字逐一请求页面,再读取返回的状态码,以此判断 ChatGPT、Claude、Perplexity 等背后的爬虫能否取到页面。测试一共用了八个爬虫名,八个请求全部返回 200,也就是说站点上没有设置把这些机器挡在门外。
这份自查记录在 2026 年 10 月 3 日由 DEV Community 的 AI 栏目发布,原文首发于 yappatyih.com。作者把结论放在最前面:八个爬虫名,八个 200。
同一轮检查真正发现的问题在别处:robots.txt 里有一行 Disallow: /og/,把每一页的预览图都屏蔽掉了。也就是说,这次自查没有测出爬虫被拦,但顺带查出了预览图被 robots.txt 屏蔽这一项。
AI 综合 1 篇报道生成 · 更新于 12 分钟前
最新进展有开发者用八个爬虫名(ChatGPT、Claude、Perplexity 等)逐一请求自己的站点,检查 AI 爬虫能否抓取页面,结果八个全部返回 200。同一轮检查发现的问题在别处:robots.txt 里一行 Disallow: /og/ 屏蔽了每页的预览图。
- 热度指数
- 31
- 独立来源
- 1
- 报道数
- 1
- 首报
- 2 天前
这件事的报道 点标题看原文
有开发者用八个爬虫名(ChatGPT、Claude、Perplexity 等)逐一请求自己的站点,检查 AI 爬虫能否抓取页面,结果八个全部返回 200。同一轮检查发现的问题在别处:robots.txt 里一行 Disallow: /og/ 屏蔽了每页的预览图。
想弄清 AI 爬虫为何不收录你站点的,可照这个方法自查
DEV Community · AIAI 评分 58
同时在说的其他事
- 热度指数 41给开发者的 GEO 清单:让内容被 ChatGPT 等引用1 个来源
- 热度指数 84GPTBot 被 Cloudflare WAF 拦截的检测与修复方法1 个来源
- 热度指数 6830 分钟手动审计:品牌是否被 ChatGPT 等推荐1 个来源
- 热度指数 43NetPulse:一句话让 Agent 给多台 VPS 体检1 个来源
- 热度指数 38导游应用自建 MCP server 接入 Claude1 个来源
- 热度指数 37Claude API 余额用尽返回 400,整条流水线被中断1 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
