Meta-ExternalAgent(Meta-ExternalAgent)

AI 爬虫爬虫 —— 开发商、用户代理 UA 与 robots.txt 拦截方法

Meta-ExternalAgent AI 爬虫
开发商
Meta
用户代理
Meta-ExternalAgentmeta-externalfetcher
通过 Robots.txt 拦截
User-agent: Meta-ExternalAgent
User-agent: meta-externalfetcher
Disallow: /
把以上片段加入网站根目录的 robots.txt 即可要求该蜘蛛停止抓取全部页面(需改为只拦某个目录,把 Disallow: / 换成对应路径)。 注意:Meta-ExternalAgent 抓取的内容用于 AI 模型训练与问答,不参与搜索引擎收录,拦截它不影响你在搜索结果中的排名;如不希望站点内容被用于 AI 训练,建议直接按上方片段拦截。

详细介绍

Meta-ExternalAgent 是 Meta 用于 AI 功能与模型训练的抓取爬虫,meta-externalfetcher 用于用户触发的实时抓取。

拦截方式:User-agent: Meta-ExternalAgent。
💡 本篇收录于搜索引擎蜘蛛大全」, 配合「网站日志分析工具」可自动识别该蜘蛛在日志中的访问与抓取页面。

同类蜘蛛推荐