搜索引擎蜘蛛大全

常用爬虫的 UA 关键词与身份说明 —— 配合「网站日志分析」识别日志里的搜索引擎访问

搜索引擎蜘蛛(Spiders / Crawlers)是搜索引擎派出的抓取程序,按域名内的 robots.txt 规则访问页面并建立索引。 判断一条访问是不是蜘蛛,最可靠的办法是反查 IP 的 PTR 记录(如 Baiduspider 的 IP 均反解为 *.baiduspider.com), 日常快速判断则看 User-Agent 里的关键词。下表整理了常见蜘蛛的 UA 关键词,供对照网站日志使用。
💡 怎么用?把 Nginx/Apache 访问日志粘贴到 网站日志分析工具,工具会自动识别上表中的蜘蛛,并统计各蜘蛛的抓取量与抓取页面。 注意:部分 SEO 工具爬虫(AhrefsBot、SemrushBot 等)抓取频率高但不产生搜索流量,如需屏蔽可在 robots.txt 中 Disallow 对应 UA。