apache禁止搜索引擎收录、网络爬虫采集的配置方法

更新时间：2014年06月30日 08:48:10 投稿：junjie

这篇文章主要介绍了apache禁止搜索引擎收录、网络爬虫采集的配置方法,注意一定要写到Location节点,否则不起作用,可以精确匹配,也可以IP匹配,需要的朋友可以参考下

Apache中禁止网络爬虫，之前设置了很多次的，但总是不起作用，原来是是写错了，不能写到Dirctory中，要写到Location中

<Location />

SetEnvIfNoCase User-Agent "spider" bad_bot

BrowserMatchNoCase bingbot bad_bot

BrowserMatchNoCase Googlebot bad_bot

Order Deny,Allow

#下面是禁止soso的爬虫

Deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209

Deny from env=bad_bot

</Location>

这是禁止了所有包含spider字符的爬虫。
如果要针对性的禁止爬虫，改成精确匹配的爬虫字符串，如果bingbot、Googlebot等等

您可能感兴趣的文章:

Linux远程登录实现教程解析
这篇文章主要介绍了Linux远程登录实现教程解析,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
2020-05-05
linux环境下安装mysql8.0过程介绍
大家好，本篇文章主要讲的是linux环境下安装mysql8.0过程介绍，感兴趣的同学赶快来看一看，对你有帮助的话记得收藏一下，方便下次浏览
2021-12-12
Ubuntu如何修改时区为UTC/CST时间
这篇文章主要介绍了Ubuntu如何修改时区为UTC/CST时间问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教
2024-07-07
linux查找日志cat和grep方式
在Linux系统中,我们常常需要查询日志文件中的特定信息,这时候掌握一些关键字查询技巧就显得非常重要,例如,要查询关键字前后30行,可以使用grep命令的'-C'选项,若要查询两个关键字同时出现的情况,可以将grep命令连续使用,对于压缩后的文件
2024-10-10
eclipse3.2.2 + MyEclipse5.5 + Tomcat5.5.27 配置数据库连接池
首先有一点要明确, 我是个新手, 而我所知道的只是一个表面, 根源我并不了解, 目前也不打算去深究. 所以我的方法, 可能只适用于eclipse3.2.2 + MyEclipse5.5 + Tomcat5.5.27 的数据库连接池的配置, 其他版本我无法保证.至少Tomcat 6的admin包还没出, 所以我的方法肯定不适用于Tomcat 6.
2008-10-10
详解如何在Linux(CentOS 7)命令行模式安装VMware Tools
本篇文章主要介绍了如何在Linux(CentOS 7)命令行模式安装VMware Tools，具有一定的参考价值，感兴趣的小伙伴们可以参考一下。
2017-03-03
解决VScode配置远程调试Linux程序的问题
这篇文章主要介绍了VScode配置远程调试Linux程序及问题解决办法，本文给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
2020-08-08
在CentOS 7下安装Redis和MongoDB教程
本篇文章主要介绍了在CentOS 7下安装Redis和MongoDB教程，有需要的可以了解一下。
2016-11-11
centos 7 源码安装openssh的方法
这篇文章主要介绍了centos 7 源码安装openssh的方法，本文通过实例代码给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
2020-06-06
浅谈Linux下免密码切换到root用户当注意的问题
下面小编就为大家带来一篇浅谈Linux下免密码切换到root用户当注意的问题。小编觉得挺不错的。现在就分享给大家。也给大家做个参考。一起跟随小编过来看看吧
2016-12-12

apache禁止搜索引擎收录、网络爬虫采集的配置方法

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具