点击进入链接,除了原网页,分别出现:
http://www.stcash.com/5273/comment-page-1
http://www.stcash.com/5273?replytocom=1989
前面一篇文章居然出现一个三级目录,后面一篇文章又类似于动态网页网址。我文章中是没有这两个链接地址的,查看网页源码,看出了一点端倪。
原因分析:
我发现了这两个?replytocom=1989网址的来源:文章评论链接
四个评论刚好对应四个replytocom,百度蜘蛛可能有一定的智能,四个replytocom网址中只收录了一个,但是又不够智能,没有区分出来评论链接和原文链接对应的文章内容是相同的。
comment-page-1网址同样是来源于评论链接,comment-page-1代表着评论页面的**页。如果我的评论比较多,比如说有1000条评论,那么一页肯定是显示不下去的,就会出现comment-page-2,comment-page-3......这就是评论分页功能,这个功能本质上是防止评论过多时,网页会被拉的很长,导致网页加载速度慢和用户体验差。但是不巧的是,百度蜘蛛依然不能识别出来这和原文
解决方法:
1、对于comment-page-1重复收录,有两种方式解决
1)在wordpress后台关闭评论分页
2)修改robots.txt,加上一句项目的代码
Disallow: /comment-page-
robots.txt在网站根目录,使用 网址/robots.tx就可以看到设置的结果了。如果根目录下没有这个文件
wp-includes/funtion中有这么一段代码:
在 $output .= "Disallow: $path/wp-admin/\n"; 后面增加一句$output .= "Disallow: $path/comment-page-\n";
2、对于replytocom重复收录,设置robots.txt文件
Disallow:/*?replytocom=
或者是加上对于包含replytocom的所有链接都加上nofollow链接
以上就是对文章被百度重复收录的原因及解决方法全部内容的介绍,更多内容请继续关注安达网络工作室!
以上就是安达网络工作室对于《文章为什么被反复收录? 文章被百度反复收录的缘由及处理办法》的一些看法。更多内容请查看本栏目更多内容!
原创文章被抄袭怎么办?如何防止?本文就给大家详细介绍下避免原创文章被抄袭的方法,感兴趣的朋友们可以过...
这几天没少在QQ群看到卖这个教程的广告,广告的内容很是吸引人,什么SEO快速排名,1分钟见效,马上排名百度...
怎么查询ip是否为百度蜘蛛ip?我们为了看网站的收录,每天都会查看网站的日志,日志中有很多ip,怎么才能知...
这篇文章主要介绍了京东在数据挖掘方面对推荐技术的优化,讲述了算法改进给用户体验带来的提升,需要的朋友可...
如何利用QQ群推广网站?QQ群推广也是一种流行的推广方法,很多朋友们还不了解,本文就给大家详细介绍下网站...
今天小编为大家带来了SEO技巧之如何优化网站能提高百度收录相关内容的介绍,感兴趣的朋友们可以跟着小编去下...