搜索引擎如何判断文章原始出处的? 5
很多人都在做伪原创,但是有些文章还是被搜索引擎发现,认为原来的那个是该文章的出处,那搜索引擎是怎么判定的?...
很多人都在做伪原创,但是有些文章还是被搜索引擎发现,认为原来的那个是该文章的出处,那搜索引擎是怎么判定的?
展开
2个回答
展开全部
搜索引擎如何判断文章原始出处?
你肯定不愿意自己的一篇原创文章被别人转载后,排名还比自己的网站文章好。搜索引擎到底是怎样判断文章原始出处呢?大致有以下几点:
1、网站的PR值,相对高的PR值被认为文章原始出处的可能性就大。
2、被转载后的反向链接。文章中如果出现反向链接,而反向链接是指向某个页面,那个页面被认为文章原始出处的可能性就大。
3、网页第一次被收录的时间越早,被认为文章原始出处的可能性就大。(看快照)
4、网站的权威性和注册时间。
说实话,现在的搜索引擎还没有很好的解决这个问题,因为比较难。比如我的网站,文章都是原创,而且没有PR,才建没多久,如果别的大型网站转载了我的文章,即使我的文章早已被收录,很有可能大型网站的那篇文章的排名比我自己的还要好。有些事情不是我们站长可以解决的,要等搜索引擎的不断进步。
---------------------------------------
搜索引擎如何判断文章或网页的原始出处?
复制内容网页有的时候会影响网页在搜索引擎中的排名。
比如说原本是你写的文章,本来应该排名很好,但是其他人抄袭或转载你的文章,而且搜索引擎不幸的判断那篇被抄袭或转载的网页是原始出处的话,你应有的排名就会被那个网页夺走。
那么搜索引擎怎样才能从多个网页中挑出哪一个是原始出处呢?可能有以下几个考虑:
1)网页PR值。网页PR值越高,被认为是原始版本的可能性就越大。
2)网页第一次被收录的时间。网页被搜索引擎收录的时候越早,相比后发现的相同内容的网页来说,被当作原始出处的可能性就越大。
3)域名注册时间。越老的域名上面的网页被当成原始出处的可能性也越大。
4)网站的权威度。这就有点说不清了,可能包含前面3个因素,还有很多其他因素。
但到目前为止,无论以哪一个因素为主,或怎样组合这些因素,都不可能完全正确从多个网页中挑出原始出处。
比如说我这个博客就很新,域名也很新,文章被收录的时间有的时候也不一定是最早的,就权威地位和被信任度来说,也肯定比不上很多中文网站。但我的博客新,我的域名新,并不意味着我的内容就不是原始出处,实际上我的所有博客都是原创。
我最近也发现了很多网站都转载,有的时候是抄袭我的博客内容,很多网站的规模,历史,PR值都比我的网站要高的多。
在检测文章原始出处方面,Google做的比较好,基本上能够正确判断,百度做的就比较差。从我的文章在不同的地方出现的情况看,百度似乎认为域名比较老的就是原创。
这个问题不是网站管理员自己可以解决的,只有依靠搜索引擎算法的改进。
你肯定不愿意自己的一篇原创文章被别人转载后,排名还比自己的网站文章好。搜索引擎到底是怎样判断文章原始出处呢?大致有以下几点:
1、网站的PR值,相对高的PR值被认为文章原始出处的可能性就大。
2、被转载后的反向链接。文章中如果出现反向链接,而反向链接是指向某个页面,那个页面被认为文章原始出处的可能性就大。
3、网页第一次被收录的时间越早,被认为文章原始出处的可能性就大。(看快照)
4、网站的权威性和注册时间。
说实话,现在的搜索引擎还没有很好的解决这个问题,因为比较难。比如我的网站,文章都是原创,而且没有PR,才建没多久,如果别的大型网站转载了我的文章,即使我的文章早已被收录,很有可能大型网站的那篇文章的排名比我自己的还要好。有些事情不是我们站长可以解决的,要等搜索引擎的不断进步。
---------------------------------------
搜索引擎如何判断文章或网页的原始出处?
复制内容网页有的时候会影响网页在搜索引擎中的排名。
比如说原本是你写的文章,本来应该排名很好,但是其他人抄袭或转载你的文章,而且搜索引擎不幸的判断那篇被抄袭或转载的网页是原始出处的话,你应有的排名就会被那个网页夺走。
那么搜索引擎怎样才能从多个网页中挑出哪一个是原始出处呢?可能有以下几个考虑:
1)网页PR值。网页PR值越高,被认为是原始版本的可能性就越大。
2)网页第一次被收录的时间。网页被搜索引擎收录的时候越早,相比后发现的相同内容的网页来说,被当作原始出处的可能性就越大。
3)域名注册时间。越老的域名上面的网页被当成原始出处的可能性也越大。
4)网站的权威度。这就有点说不清了,可能包含前面3个因素,还有很多其他因素。
但到目前为止,无论以哪一个因素为主,或怎样组合这些因素,都不可能完全正确从多个网页中挑出原始出处。
比如说我这个博客就很新,域名也很新,文章被收录的时间有的时候也不一定是最早的,就权威地位和被信任度来说,也肯定比不上很多中文网站。但我的博客新,我的域名新,并不意味着我的内容就不是原始出处,实际上我的所有博客都是原创。
我最近也发现了很多网站都转载,有的时候是抄袭我的博客内容,很多网站的规模,历史,PR值都比我的网站要高的多。
在检测文章原始出处方面,Google做的比较好,基本上能够正确判断,百度做的就比较差。从我的文章在不同的地方出现的情况看,百度似乎认为域名比较老的就是原创。
这个问题不是网站管理员自己可以解决的,只有依靠搜索引擎算法的改进。
参考资料: http://hi.baidu.com/jiangleipp1/blog/item/b9c01a7b1695abeb2f73b366.html
推荐律师服务:
若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询