当前位置: 医院网络营销 > 医院seo优化 > 百度优化 >

百度判断原创和伪原创规则

时间:2014-09-02 18:07来源:未知 作者:admin 点击:
我们要弄清俩个概念: 原创:简单地理解就是第一次在网络上发表的内容,以前没有出现过的内容。 伪原创:就是从网站找来资料进行二次加工,二次修改之后的内容,如修改标题,

  我们要弄清俩个概念:

  原创:简单地理解就是第一次在网络上发表的内容,以前没有出现过的内容。

  伪原创:就是从网站找来资料进行二次加工,二次修改之后的内容,如修改标题,修改内容,增加些文字或者减少一些文字等。

  那么搜索引擎怎样判断文章是否为伪原创?

  一般来讲有以下几个方面的因素决定:

  一、网页PR值。网页PR值越高,被认为是原始版本的可能性就越大。

  二、网页第一次被收录的时间。网页被搜索引擎收录的时候越早,相比后发现的相同内容的网页来说,被当作原始出处的可能性就越大。

  如果蜘蛛先访问了B站呢?

  1、当然权重给B站,一般的情况下都会这样!

  2、如果B站转载的文章带了A站的原文章页面链接呢?

  3、这就很明白了,刚收录的时候,如果排名,两条结果一起出现,有可能还是B站的排名好一点。

  当然,文章转载次数多了以后,A站的链接越多,对A站的文章越有好处,排名会慢慢变成A站在前面。

  如果另外转载的文章带的是B站页面的链接呢?

  它们如果判断不好,就变成了一个链接流行度的比赛了。

  不过,如果都有很多外部链接,并且相差不大,那么判断的规则应该回到原点,谁先被收录谁就是原创。

  三、域名注册时间。越老的域名上面的网页被当成原始出处的可能性也越大。

  四、网站的权威度。这就有点说不清了,可能包含前面3个因素,还有很多其他因素。

  五、快照日期

  快照日期显示时间最早的,一般就是原创了吧!

  不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。

  但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!

  还有其它的可能吗?

  有,一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站的结果放出来了,而A站还在数据库里。

  所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。

  这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎的信任度并不高的时候。不过只要是A站先被访问到的,原创权还是A站的,这是最难分出来的情况,因为我们不知道蜘蛛先访问哪个站,除非你知道两个站的网站空间日志内容,能看到搜索引擎对两个页面的访问时间。

  六、伪原创

  伪原创也会被认为是原创?

  大多时候是这样的,搜索引擎蜘蛛不能明确分别这些东西,因为它的思维太程式化了。如果你的标题改过,文章的段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复的,但它也不能因为这些而将这篇文章确认为是转载!当然,随着搜索引擎程式设计的提高,应该会有一个相似度的东西出来,比如文字内容相似度超过百分之几就会被认为是转载.

(责任编辑:
顶一下
(0)
0%
踩一下
(0)
0%
------分隔线----------------------------

网站建设