百度如何判断网站文章是否原创

作者:im286 来源:CHINAZ 时间:2008-12-22 09:41:00 



大量复制内容网站有的时候会影响关键字的排名。

比如说原本是你写的文章,本来应该排名很好,但是其他人抄袭或转载你的文章,而且搜索引擎不幸的判断那篇被抄袭或转载的网页是原始出处的话,你应有的排名就会被那个网页夺走。

那么搜索引擎怎样才能从多个网页中挑出哪一个是原始出处呢?可能有以下几个考虑:

1)网页PR值。网页PR值越高,被认为是原始版本的可能性就越大。

2)网页第一次被收录的时间。网页被搜索引擎收录的时候越早,相比后发现的相同内容的网页来说,被当作原始出处的可能性就越大。

3)域名注册时间。越老的域名上面的网页被当成原始出处的可能性也越大。

4)网站的权威度。这就有点说不清了,可能包含前面3个因素,还有很多其他因素。

但到目前为止,无论以哪一个因素为主,或怎样组合这些因素,都不可能完全正确从多个网页中挑出原始出处。

比如说我这个博客就很新,域名也很新,文章被收录的时间有的时候也不一定是最早的,就权威地位和被信任度来说,也肯定比不上很多中文网站。但我的博客新,我的域名新,并不意味着我的内容就不是原始出处,实际上我的所有博客都是原创。

我最近也发现了很多网站都转载,有的时候是抄袭我的博客内容,很多网站的规模,历史,PR值都比我的网站要高的多。

在检测文章原始出处方面,Google做的比较好,基本上能够正确判断,百度做的就比较差。从我的文章在不同的地方出现的情况看,百度似乎认为域名比较老的就是原创。(diyfzl.cn)

标签:
0
投稿

猜你喜欢

  • Godaddy主机如何绑定域名到子文件夹新建网站的说明 Godaddy

    2010-04-21 12:48:00
  • 英文网站不可缺少的六个页面

    2007-11-20 12:28:00
  • 基于linux的Web服务器性能测试

    2010-05-02 18:10:00
  • 在Google AdSense帐户中使用谷歌分析工具

    2008-10-30 18:29:00
  • eWebeditor的漏洞利用

    2009-11-03 13:15:00
  • 建站经验之域名选择篇诠释

    2008-01-29 12:44:00
  • 百度知道文档分享平台携五千个文档正式上线

    2009-11-13 15:07:00
  • 南京200大学生集体投身电子商务

    2009-10-17 16:01:00
  • 很菜的菜鸟 提高网站流量的五个心得经验

    2008-12-08 10:32:00
  • eBay看好分类广告前景 将在全球市场进行收购

    2009-12-03 08:35:00
  • 谷歌不为人知的十件事:布林曾为Wolfram打工

    2009-10-14 13:27:00
  • 站内结构对于英文站优化很重要

    2009-07-07 16:34:00
  • dedecms广告生成JS文件和JS调用-DEDE广告优化

    2010-12-08 16:19:00
  • Windows7全球发布会图文直播实录

    2009-10-23 08:36:00
  • GoDaddy:如何建立404错误页面 Godaddy

    2010-04-23 12:43:00
  • Robin主持:你问我答001期

    2008-12-29 10:56:00
  • 论坛推广四要素

    2010-03-07 16:30:00
  • WordPress高级技巧,打造个性keywords

    2008-02-13 13:14:00
  • 巧用Manyou开放平台 你的SNS应用排序你做主

    2009-02-15 09:53:00
  • 国内最新模板引擎xingTemplate介绍

    2009-10-28 11:04:00
  • asp之家 网站运营 m.aspxhome.com