前言
很多站长、运维、网站运营者,在服务器日志、访问统计、防火墙拦截记录中,经常看到陌生访问 UA:
WellKnownBot。
不少新手误以为这是搜索引擎正规爬虫(百度、谷歌、必应机器人),直接放行流量,结果导致网站被高频扫描、接口被暴力请求、服务器带宽被耗尽、敏感路径被探测,甚至触发网站漏洞爆破。
事实恰恰相反:
WellKnownBot 不属于任何正规搜索引擎,是典型的恶意扫描爬虫、恶意僵尸探测机器人,专门用于全网网站资产探测、漏洞扫描、目录爆破、压力测试。
本文零基础讲透 WellKnownBot 的真实身份、攻击特征、危害、日志识别方法、Nginx/Apache/防火墙拦截方案、永久防护策略,全文 SEO 优化,适配百度收录,站长必看收藏。
一、WellKnownBot 是什么?通俗定义
WellKnownBot 是互联网广泛流传的
恶意自动化爬虫(Bad Bot),属于批量资产探测僵尸程序,常被黑客、扫描器工具、自动化攻击框架携带。
它的核心用途不是收录网站内容,而是
批量扫描全网域名、探测存活站点、扫描敏感目录、探测弱口令、扫描常见漏洞接口。
和百度爬虫、谷歌爬虫等正规收录 Bot 完全不同:
- 正规爬虫:遵守 robots 协议、访问频率低、模拟正常浏览、用于网页收录
- WellKnownBot:无视 robots 协议、高频疯狂请求、遍历全量路径、纯探测攻击行为
简单总结:
WellKnownBot 是百分百恶意探测机器人,不是搜索引擎爬虫,必须拦截封禁。
二、WellKnownBot 核心攻击行为(99%站长都中招)
服务器日志出现 WellKnownBot 访问记录,代表网站正在被自动化批量探测,常见行为如下:
- 全网资产探测:批量扫描端口、域名、站点存活状态,收集网站资产信息
- 敏感目录爆破:扫描后台、admin、login、phpinfo、备份文件等高危路径
- 漏洞自动化探测:批量请求常见漏洞接口、弱口令接口、源码泄露点
- 高频CC压测:短时间大量请求,占用服务器CPU、带宽、连接数,导致网站卡顿
三、如何精准识别 WellKnownBot 访问?日志特征
打开网站 Nginx/Apache 访问日志,搜索关键词
WellKnownBot,满足以下特征即可确认恶意扫描:
1、固定 UA 特征
HTTP 请求 User-Agent 字段携带:
WellKnownBot 字段,无正规浏览器标识、无搜索引擎标识。
2、访问行为异常
- 每秒多次高频请求,访问频率远超正常用户
- 大量遍历访问非常规页面、隐藏路径、备份地址
- 不加载静态资源,只疯狂请求动态接口与目录
3、IP 特征杂乱
访问 IP 多为海外代理、动态节点、扫描服务器 IP,无固定访问源,批量轮换探测。
四、WellKnownBot 带来的真实危害
- 服务器资源耗尽:高频请求占用带宽、CPU、连接数,导致网站卡顿、502、503
- 暴露网站漏洞:提前探测出后台地址、漏洞接口、源码泄露,为黑客入侵铺路
- 影响百度收录:恶意爬虫大量无效请求,导致搜索引擎判定网站不稳定,降权掉收录
- 触发机房风控:异常高频访问,容易触发机房异常流量风控,导致IP临时封禁
- 衍生攻击风险:探测完成后,大概率跟进弱口令爆破、SQL注入、后台登陆攻击
五、一键拦截 WellKnownBot 实操教程(全场景通用)
WellKnownBot 无任何合法用途,运维最佳策略:
全局拦截、彻底封禁,零放行。下面提供可直接复制的拦截配置。
1、Nginx 拦截配置(最常用)
在 nginx.conf 或站点配置文件中加入 UA 拦截规则:
if ($http_user_agent ~* "WellKnownBot") { return 403; } 重载 Nginx 即可生效,彻底拒绝所有 WellKnownBot 访问。
2、Apache 拦截配置
RewriteEngine On RewriteCond %{HTTP_USER_AGENT} WellKnownBot [NC] RewriteRule ^.*$ - [R=403,L]
3、防火墙/安全组拦截
云服务器安全组、宝塔防火墙、硬件防火墙,配置自定义 UA 拦截规则,拦截包含
WellKnownBot 的所有请求,全局阻断探测流量。
4、Robots.txt 屏蔽(辅助加固)
虽然恶意 Bot 大概率无视协议,但依旧建议配置,做基础合规拦截:
User-agent: WellKnownBot Disallow: /
六、高级防护:批量拦截所有恶意爬虫
除了 WellKnownBot,网络中还有大量同名恶意爬虫、扫描机器人,建议批量拦截高危 UA,彻底杜绝自动化探测:
常见恶意 Bot 特征:WellKnownBot、ScanBot、AttackBot、BulkBot、SpiderBot 等非正规爬虫标识。
统一拦截后,可大幅降低网站被扫描、爆破、压测的概率,提升网站稳定性与安全性。
七、站长常见误区避坑
误区1:WellKnownBot 是正规搜索引擎爬虫,可以放行
纠正:完全错误,无任何正规搜索引擎使用该 UA,100%恶意探测。
误区2:流量不大,不用管
纠正:探测是入侵前置动作,放任扫描=主动暴露漏洞,极易后续被定向攻破。
误区3:只封IP就能解决
纠正:攻击者海量代理IP轮换,封IP无效,必须
拦截UA特征根治。
误区4:robots.txt 可以彻底拦截
纠正:恶意爬虫无视爬虫协议,必须依靠服务器防火墙强制拦截。
八、全文总结
WellKnownBot 是典型的恶意自动化探测爬虫,不属于正规收录机器人,核心作用是全网站点扫描、漏洞探测、目录爆破、压力测试,对个人网站、企业官网、业务系统存在极大安全隐患。
站长运维无需犹豫,标准处理方案:
识别UA特征、服务器强制403拦截、防火墙策略封禁、批量屏蔽恶意爬虫,从源头阻断探测攻击,保护网站安全稳定运行,同时避免恶意流量影响百度收录与网站权重。
#WellKnownBot #WellKnownBot拦截 #恶意爬虫防护 #网站安全加固 #服务器防扫描 #站长运维干货 #恶意Bot拦截 #网站被扫描解决方法 #网络安全防护 #运维教程
关于墨者安全
墨者安全致力于安全防护、服务器高防、网络高防、ddos防护、cc防护、dns防护、防劫持、高防服务器、高防dns、网站防护等方面的服务,全网第一款指纹识别技术防火墙,自研的WAF指纹识别架构,提供任意CC和
DDoS攻击防御