欢迎您访问程序员文章站本站旨在为大家提供分享程序员计算机编程知识!
您现在的位置是: 首页  >  网络运营

apache禁止搜索引擎收录、网络爬虫采集的配置方法

程序员文章站 2023-10-28 14:47:46
apache中禁止网络爬虫,之前设置了很多次的,但总是不起作用,原来是是写错了,不能写到dirctory中,要写到location中 复制代码 代码如下:

apache中禁止网络爬虫,之前设置了很多次的,但总是不起作用,原来是是写错了,不能写到dirctory中,要写到location中

复制代码 代码如下:

<location />
setenvifnocase user-agent "spider" bad_bot
browsermatchnocase bingbot bad_bot
browsermatchnocase googlebot bad_bot
order deny,allow
#下面是禁止soso的爬虫
deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209
deny from env=bad_bot
</location>

这是禁止了所有包含spider字符的爬虫。
如果要针对性的禁止爬虫,改成精确匹配的爬虫字符串,如果bingbot、googlebot等等