apache禁止收录爬虫采集 apache禁止搜索引擎收录、网络爬虫采集的配置方法

软件发布|下载排行|最新软件

当前位置:首页IT学院IT技术

apache禁止收录爬虫采集 apache禁止搜索引擎收录、网络爬虫采集的配置方法

  2021-03-19 我要评论
想了解apache禁止搜索引擎收录、网络爬虫采集的配置方法的相关内容吗,在本文为您仔细讲解apache禁止收录爬虫采集的相关知识和一些Code实例,欢迎阅读和指正,我们先划重点:apache,禁止搜索引擎收录,禁止网络爬虫采集,下面大家一起来学习吧。

Apache中禁止网络爬虫,之前设置了很多次的,但总是不起作用,原来是是写错了,不能写到Dirctory中,要写到Location中

复制代码 代码如下:

<Location />
SetEnvIfNoCase User-Agent "spider" bad_bot
BrowserMatchNoCase bingbot bad_bot
BrowserMatchNoCase Googlebot bad_bot
Order Deny,Allow
#下面是禁止soso的爬虫
Deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209
Deny from env=bad_bot
</Location>

这是禁止了所有包含spider字符的爬虫。
如果要针对性的禁止爬虫,改成精确匹配的爬虫字符串,如果bingbot、Googlebot等等

猜您喜欢

Copyright 2022 版权所有 软件发布 访问手机版

声明:所有软件和文章来自软件开发商或者作者 如有异议 请与本站联系 联系我们