企业视频展播区
  • 新闻中心

    浅析百度搜索引擎是如何辨别原创文章的规律有哪些?

    发表时间:2012-5-2  [打印]

     
            搜索引擎算法的变化或许会让网站只有昙花一现的表现,排名做上去容易,稳定排名却很难;当我们的关键词出现做不上去,或经常徘徊在第二页时,除了分析排名前面的网站外,还得好好反思一下自己的网站是否内部出现一些问题,必须通过站内的调整才能改善排名困难的现象

           如果我在我的网站更新了一篇文章新闻。搜索引擎来到这个网站并且抓取到了这篇文章,放到数据库,并且在收录数据库中没有发现类似内容,那么就会被认为是原创。

    在这点上有个细节需要注意:

    第一 伪原创
           在搜索引擎蜘蛛不能明确分别这些东西,因为它的思维太程式化了。如果你的标题改过,文章的段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复的,但它也不能因为这些而将这篇文章确认为是转载!

    第二 文章被转载
          如果刚发表的一篇文章被其它转载了,那么谁是原创呢?那要看谁更先被搜索引擎抓取到,也就是更新周期的问题了。
     
    第三 文章收录 
          前题是保证文章被收录,如果没有被收录,肯定是在搜索数据库中石找不到的,搜索引擎根本就找不到这篇文章,更谈不上什么原创了。

    第四 快照日期显示时间最早的,一般就是原创了吧!
           不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。
    但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!

            一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,而后可能搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。

            搜索引擎对伪原创已不是那么感冒了,内链的网站建设一定要考虑到文章的相关性,最好能够跟文章主题紧密相结合的,那效果会更好,只要用户跟类似的话题感兴趣,一般会继续浏览其他的文章。


     

    更多