禁止搜索引擎抓取网站内容的方法有哪些,为何要这样做
Admin 2022-06-10 群英技术资讯 1447 次浏览
这篇文章主要讲解了“禁止搜索引擎抓取网站内容的方法有哪些,为何要这样做”,文中的讲解内容简单、清晰、详细,对大家学习或是工作可能会有一定的帮助,希望大家阅读完这篇文章能有所收获。下面就请大家跟着小编的思路一起来学习一下吧。可能有的朋友会奇怪,网站的页面不是让搜索引擎抓的越多越好吗,怎么还会有怎么让网站页面内容不被抓取的想法。
首先,一个网站可以分出去的权重是有限,哪怕是Pr10的站,也不可能无限的分权重出去。这权重包括链到别人网站的处链以及自己网站内的内链。
外链的话,除非是想坑被链的人。否则外链都是需要让搜索引擎所抓取。这不在本文讨论范围之内。
而内链,因为有些网站有不少重复或冗余的内容。 比如一些按条件查询的搜索结果。特别是一些B2C站,在专门查询页或在所有产品页面的某个位置内,都可以按产品类型,型号,颜色,大小等进行分类搜索。这些页面虽然对浏览者来说是极大的方便,但对搜索引擎来说,这可是耗费蜘蛛极大的抓取时间,特别是网站页面较多时。同时也会分散页面权重,对SEO不利。
另外网站管理登陆页面,备份页面,测试页面等等,也是站长不想让搜索引擎所收录的。
所以就有需要让网页的某些内容,或某些页面不被搜索引擎所收录。
下面笔者先介绍一下较为有效的几种方法:
1.在FLASH展示不想被收录的内容
众所周知,搜索引擎对FLASH的内容抓取能力有限,不能完全抓取所有FLASH内的所有内容。但遗憾的是,也不能完全保证FLASH的所有内容都不会被抓取。因为谷歌和Adobe正努力的实现FLASH抓取技术。
2.使用robos文件
这是暂时最有效的方法,但有个很大的缺点。就是不传出任何的内容及链接。大家知道,在SEO来说比较健康的页面应该是有进有出的。有外链的链入,同时也页面内也需要有链到外部网站的链接,所以robots文件控制,让此页面只进不出,搜索引擎也不知道内容是什么。会把此页定为低质量页面。权重有可能受一定的惩罚。这个多用于网站管理页面,测试页面等。
3.使用nofollow标签包裹不想被收录的内容
这个方法也不能完全保证不被收录,因为这并不是严格要求遵守的标签。另外,如果有外部网站链向了有nofollow标签的页面。这样就很有可能会被搜索引擎抓取。
4.用Meta Noindex标签加上follow标签
这个方法可以做到防止收录而且还能传递出权重。要不要传递,看网站建设站长自己的需要。这个方法的缺点是,也是会较大的浪费蜘蛛的抓取页面时间。
5.用robots文件的同时在页面上使用iframe标签展示需要搜索引擎收录的内容robots文件可以阻止iframe标签以外的内容被收录 。所以,可以把不想收录的内容放到正常页面标签下。而想被收录的内容放在iframe标签内。
紧接着,再说一下已经失效的方法,大家以后不要用这些方法了。
1.使用表格
谷歌和百度早已经能抓取表格用的内容了,无法阻止收录。
2.使用Javascript及Ajax技术
以现在的技术来说,Ajax和javascript现在的最终运算的结果还是以HTML的形式传给浏览器以作显示,所以这同样无法阻止收录。
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:mmqy2019@163.com进行举报,并提供相关证据,查实之后,将立刻删除涉嫌侵权内容。
猜你喜欢
随着社会的不断发展,建筑行业的发展也是越来越迅速,为了响应互联网的趋势,很多的建筑公司都开始建立了属于自己的建筑公司网站,建筑公司网站建设不仅能够提高企业形象,还能拓展线上销售渠道,那么建筑公司网站建设应该注意什么呢?
BLOG流量提高的方法:1、时刻关注时事政治、最新新闻,最好能提前用敏锐的嗅觉寻出哪些是即将爆炸的新闻,然后加以利用,在个人BLOG中引导出来,博得用户的眼球,吸引流量;2、建设新颖、细心的内容;3、发表属于自己的独特观点,吸引流量,吸引用户的阅读。
清晰的导航结构对于网站建设来说至关重要,专业的网站建设公司会把导航作为重要目标,因为它对网站信息构架、用户体验影响重大
http状态码的含义:1、200,表示成功处理了请求;2、301,表示请求的网页已永久移动到新位置;3、400,表示服务器不理解请求;4、500,表示服务器遇到错误,无法完成请求。
网站索引量和收录量是很多人非常困惑的一个问题,很多人会把索引量当成收录量,把这两个弄混淆,首先网站索引量是指搜索引擎抓取层层筛选后选取的页面数量!站点内容页面需要经过搜索引擎的抓取和层层筛选后,方可在搜索结果中展现给用户;而网站收录量是指搜索引擎收录一个网站的页面数量。
成为群英会员,开启智能安全云计算之旅
立即注册关注或联系群英网络
7x24小时售前:400-678-4567
7x24小时售后:0668-2555666
24小时QQ客服
群英微信公众号
CNNIC域名投诉举报处理平台
服务电话:010-58813000
服务邮箱:service@cnnic.cn
投诉与建议:0668-2555555
Copyright © QY Network Company Ltd. All Rights Reserved. 2003-2020 群英 版权所有
增值电信经营许可证 : B1.B2-20140078 ICP核准(ICP备案)粤ICP备09006778号 域名注册商资质 粤 D3.1-20240008