百度如何判断网站文章是否原创

作者:im286 来源:CHINAZ 时间:2008-12-22 09:41:00 



大量复制内容网站有的时候会影响关键字的排名。

比如说原本是你写的文章,本来应该排名很好,但是其他人抄袭或转载你的文章,而且搜索引擎不幸的判断那篇被抄袭或转载的网页是原始出处的话,你应有的排名就会被那个网页夺走。

那么搜索引擎怎样才能从多个网页中挑出哪一个是原始出处呢?可能有以下几个考虑:

1)网页PR值。网页PR值越高,被认为是原始版本的可能性就越大。

2)网页第一次被收录的时间。网页被搜索引擎收录的时候越早,相比后发现的相同内容的网页来说,被当作原始出处的可能性就越大。

3)域名注册时间。越老的域名上面的网页被当成原始出处的可能性也越大。

4)网站的权威度。这就有点说不清了,可能包含前面3个因素,还有很多其他因素。

但到目前为止,无论以哪一个因素为主,或怎样组合这些因素,都不可能完全正确从多个网页中挑出原始出处。

比如说我这个博客就很新,域名也很新,文章被收录的时间有的时候也不一定是最早的,就权威地位和被信任度来说,也肯定比不上很多中文网站。但我的博客新,我的域名新,并不意味着我的内容就不是原始出处,实际上我的所有博客都是原创。

我最近也发现了很多网站都转载,有的时候是抄袭我的博客内容,很多网站的规模,历史,PR值都比我的网站要高的多。

在检测文章原始出处方面,Google做的比较好,基本上能够正确判断,百度做的就比较差。从我的文章在不同的地方出现的情况看,百度似乎认为域名比较老的就是原创。(diyfzl.cn)

标签:
0
投稿

猜你喜欢

  • Linux启动与停止spring boot工程的脚本示例

    2023-08-18 23:07:32
  • Google的排名算法,不在以外链为主

    2007-11-21 07:37:00
  • 重新设计网站的一些最新技巧

    2009-01-23 11:28:00
  • Web服务器实战之如何改善性能

    2007-12-11 09:31:00
  • Linux中使用有状态防火墙实现FTP功能

    2009-12-22 19:13:00
  • PChome公布新领导团队:CBSi刘小东任总经理

    2009-10-22 08:57:00
  • VMware Ubuntu安装图文教程

    2021-08-03 09:34:34
  • 蠕虫病毒近期泛滥 站长应小心应付

    2007-09-29 12:59:00
  • 做另类的行业“站长”网

    2009-01-17 16:02:00
  • arm linux利用alsa驱动并使用usb音频设备

    2023-08-14 23:56:52
  • Google AdSense广告优化之“广告位置”

    2007-12-06 18:37:00
  • VirtualBox简体中文版下载安装(图解教程)

    2021-05-26 04:45:50
  • 关于 Google Chart 用法介绍

    2008-01-13 22:21:00
  • 竞合将是未来视频行业的主旋律

    2009-10-16 09:34:00
  • Linux多线程编程(二)

    2022-03-31 16:59:52
  • 蔡文胜谈4399拒绝与百度合作:担心失去流量

    2010-09-02 12:15:00
  • 微软创始人盖茨称赞乔布斯拯救了苹果

    2009-11-14 10:07:00
  • Dedecms与Ecms的战争已入白热化

    2007-11-22 23:56:00
  • 英文网站推广虽难 但事在人为

    2009-05-15 11:58:00
  • 谷歌操作系统源码泄露 目前功能有限且易崩溃

    2009-10-14 13:55:00
  • asp之家 网站运营 m.aspxhome.com