bokee.net

总经理/总裁/CEO博客

正文 更多文章

原创文章就一定能吸引搜索引擎吗?

    都在说网站如何做搜索引擎优化,要注意哪些细节才能被搜索引擎更快收录。说的最重要的方法就是来自于文章原创,每天站长们都煞费苦心地搞原创。但是,原创就真的能吸引搜索引擎吗?搜索引擎又是如何来判别文章是否原创呢?

 

        现在很多站长都对自己的原创文章特别敏感,一看到有人转载,恨不得把他们暴打一顿,自己的原创文章被别人转去用,愤怒一定是会有的。当你的原创文章被很多人大肆转载,很可能会导致你的原创文章被搜索引擎惩罚而无法生存下去。

 

        譬如说你的原创博客站,由于是小站,更新速度是非常有限的。但搜索引擎对你网站抓取和更新频率是相对较低的话,如果你发表的原创性文章,不可能一两天内就被搜索引擎收录,而被一个权重高、规模大的网站在当天就抄袭了你的原创文章,很可能由于这个大站搜索引擎的更新频率快、权重高,每天可能都被搜索引擎抓取更新收录,那么这时候搜索引擎就会认为这个文章的原创者是这个大站。

 

       另外,有的站没道德,转载的时候不为原作者注明版权和原文地址链接,导致众多转载网站把这大站当做原创作者,都把原文连接地址指向这个大站。这也绝对可以让搜索引擎认定文章的原创者是这个大站。

 

        这样一篇两篇文章的转载没有什么。如果大站对小站下毒手,整个栏目的甚至整个站的抄袭复制。后果很严重,最终会导致搜索引擎误判这个小站是垃圾站。甚至对这个小站进行毁灭性的惩罚。也就是通常所说的K站。

 

        这类大站内容抄袭别人,很垃圾,站长也多是明知故犯,因为他们就是为了流量和广告收入。这种情况建议以法律等手段来对付这些有规模的垃圾网站站长们。想不出其他有效的手段和方法。

 

搜索引擎如何判定原创:

  一、原创:简单地理解就是第一次在网络上发表得内容。

  二、伪原创:就是对原创进行得第二次或者第N次经过修改得转载发表。比如修改标题,增加摘要,转载不完整内容等等。

 

搜索引擎对于原创得判定是如何进行得?

一般来讲有以下几个方面得因素决定:

  1、快照日期。

  2、蜘蛛抓取日期。

  3、页面外链得多少。

  4、文章修改得程度。

    举例:假如一篇标题为《搜索引擎如何确定你的就是原创内容》的文章在今天10点第一次发表在一个博客或者网站上。会有什么结果呢?

搜索引擎蜘蛛来到这个博客或者网站,发现这个页面,分析内容,放入数据库,并且被确定为首次发现,这肯定就是原创了!

那么这个收录与判定得过程中间有几个细节方面问题:

  1、必要条件

     ——假如这个网站没有被收录,这篇文章会认为是原创么?

     ——当然不是!因为它根本不可能出现在搜索数据库里!

     ——如何让它成为原创内容?

     ——第一个条件,网站必须有被搜索引擎收录。

     ——假如这个网站收录了,但是不经常更新呐?

     ——很简单,假如不经常更新,发表得文章到收录得时候也会认为是原创得。

  2、转载与采集

     ——假如文章被转载了呐?

     ——假如文章被转载,那么看转载这篇文章得站更新周期与首次发表站得更新周期哪个更快。

     ——不太明白更新周期。

     ——比如在A站发表,B站转载,假如蜘蛛先访问了A站,发现了文章,再来到B站发现了文章,很明显得,原创权重归A站。

     ——采集得情况是否符合这种情况?

     ——是得,采集得情况一样。假如B采集A,但B收录比A早,B就可能变成原创喽!

  3、访问时间

     ——假如蜘蛛先访问了B站呐?

     ——当然权重给B站,一般得情况下都会这样!

     ——假如B站转载得文章带了A站得原文章页面链接呐?

     ——这就很明白了,刚收录得时候,假如排名,两条结果一起出现,有可能还是B站得排名好一点。

     当然,文章转载次数多了以后,A站得链接越多,对A站得文章越有好处,排名会慢慢变成A站在前面。

     ——假如另外转载得文章带得是B站页面得链接呐?

     ——这种情况就搞笑了,给搜索引擎开了个玩笑,但它们假如判定不好,就变成了一个链接流行度得比赛了。

     不过,假如都有很多外部链接,并且相差不大,那么判定得规则应该回到原点,谁先被收录谁就是原创。

  4、快照日期

     ——快照日期显示时间最早得,一般就是原创了吧!

     ——不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早得地址将越有被认可为原创得可能。

但假如文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照得日期就变了!

     ——还有其它得可能么?

     ——有,一般比如百度收录,祂可能会有一个收录得数据库,经过过滤后,收录得内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站得结果放出来了,而A站还在数据库里。

       

         所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎得库存里已经有记录了,只是你查得时间没有放出来而已,就像25号才放出来得内容,但是快照是20号得,这就是搜索引擎得库存内容,同时这也是检验原创得核心时间点。

   

        这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎得信任度并不高得时候。不过只要是A站先被访问到得,原创权还是A站得,这是最难分出来得情况,因为俺们不知道蜘蛛先访问哪个站,除非你知道两个站得网站空间日志内容,能看到搜索引擎对两个页面得访问时间。

  5、伪原创

     ——伪原创也会被认为是原创?

     ——大多时候是这样得,搜索引擎蜘蛛智力相当于三岁小孩子一样,不能明确分别这些东西,因为它得思维太程式化了。假如你得标题改过,文章得段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复得,但它也不能因为这些而将这篇文章确认为是转载!当然,随着搜索引擎程式设计得提高,应该会有一个相似度得东西出来,比如文字内容相似度超过百分之几就会被认为是转载。

   

    这样分析下来,相信大家应该了解了吧。只是核桃自己得看法,希望大家吸收自己想要得东西,不认同得了也来提下自己得意见!

另外提几个建议:

  1、假如你得站是新站,权重不高,如何让蜘蛛首页找到你得页面并放入数据库?其实很简单:用网摘、百度收藏这些工具让蜘蛛更快得找到你得页面!

  2、大家都有过建议,就是加上自己得版权及内容页面得地址,别人采集得时候你就爽了,收录虽然不会快,但最后链接多了,你依然是原创内容。

  3、发表文章等到自己收录以后再去其它得站点进行发表,同时加上自己得原文地址,这种办法很有保障!大站被采得机率很大!

    

    想要让搜索引擎明白你的文章才是原创,那就得讲究一些方法,对自己的知识产权要严格保管。

 

重庆网站建设重庆网页设计

分享到:

上一篇:门户网站与中小企业网站的区别

下一篇:

评论 (0条) 发表评论

抢沙发,第一个发表评论
验证码