apache禁止搜索引擎收录、网络爬虫采集的配置方法

更新时间：2014年06月30日 08:48:10 投稿：junjie

这篇文章主要介绍了apache禁止搜索引擎收录、网络爬虫采集的配置方法,注意一定要写到Location节点,否则不起作用,可以精确匹配,也可以IP匹配,需要的朋友可以参考下

Apache中禁止网络爬虫，之前设置了很多次的，但总是不起作用，原来是是写错了，不能写到Dirctory中，要写到Location中

<Location />

SetEnvIfNoCase User-Agent "spider" bad_bot

BrowserMatchNoCase bingbot bad_bot

BrowserMatchNoCase Googlebot bad_bot

Order Deny,Allow

#下面是禁止soso的爬虫

Deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209

Deny from env=bad_bot

</Location>

这是禁止了所有包含spider字符的爬虫。
如果要针对性的禁止爬虫，改成精确匹配的爬虫字符串，如果bingbot、Googlebot等等

您可能感兴趣的文章:

linux下日志定时轮询的流程详解
这篇文章主要给大家介绍了关于在linux下日志定时轮询流程的相关资料，文中介绍的非常详细，对大家具有一定的参考学习价值，需要的朋友们下面来一起看看吧。
2017-06-06
linux环境配置nginx导致页面不刷新的解决方法
这篇文章介绍了linux环境配置nginx导致页面不刷新的解决方法，有需要的朋友可以参考一下
2013-09-09
ubuntu配置tftp服务的步骤小结
这篇文章主要介绍了ubuntu配置tftp服务的步骤小结，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2019-07-07
分享十个便宜VPS主机-VPS服务器建站和搭建应用服务体验
这篇文章主要介绍了分享十个便宜VPS主机-VPS服务器建站和搭建应用服务体验，非常具有实用价值，需要的朋友可以参考下
2017-07-07
Apache Kafka 分区重分配的实现原理解析
这篇文章主要介绍了Apache Kafka 分区重分配的实现原理,本文结合 2.0.0 版本的 Kafka 源码，详细介绍了 Kafka 分区副本重分配的流程和逻辑，需要的朋友可以参考下
2022-07-07
解决SSH连接超时的2个配置方法
用SSH客户端连接linux服务器时，经常会出现与服务器会话连接中断现象，照成这个问题的原因便是SSH服务有自己独特的会话连接机制。
2014-04-04
Windows 10 下安装 Apache 2.4.41的教程
这篇文章主要介绍了Windows 10 下安装 Apache 2.4.41的教程，本文给大家介绍的非常详细，具有一定的参考借鉴价值,需要的朋友可以参考下
2020-01-01
linux如何编译安装新内核支持NTFS文件系统(以redhat7.2x64为例)
这篇文章主要介绍了linux如何编译安装新内核支持NTFS文件系统(以redhat7.2x64为例)，具有一定的参考价值，感兴趣的小伙伴们可以参考一下。
2016-10-10
Linux 6 修改ssh默认远程端口号的操作步骤
这篇文章主要介绍了Linux 6 修改ssh默认远程端口号的操作步骤，本文给大家介绍的非常详细，具有一定的参考借鉴价值,需要的朋友可以参考下
2019-09-09
Linux 命令行通配符及转义符的实现
这篇文章主要介绍了Linux 命令行通配符及转义符的实现，小编觉得挺不错的，现在分享给大家，也给大家做个参考。一起跟随小编过来看看吧
2018-11-11