当前位置:首页 > SEO优化 > 正文内容

恋吧也来侃侃—搜索引擎是如何认定你的网站内容是原创?

admin17年前 (2009-05-04)SEO优化746
很多人在群里聊到一些事情,比如原创是如何被搜索引擎确定的?站长今天分享一下对搜索引擎确定原创内容的看法。
首先我们要明确两个概念:原创与伪原创
原创:简单地理解就是第一次在网络上发表的内容。
伪原创:就是对原创进行的第二次或者第N次经过修改的转载发表。比如修改标题,增加摘要,转载不完整内容等等。
搜索引擎对于原创的判断是如何进行的呢?
一般来讲有以下几个方面的因素决定:
1、快照日期。
2、蜘蛛抓取日期。
3、页面外链的多少。
4、文章修改的程度。
举例:如果一篇标题为《搜索引擎如何确定你的就是原创内容》的文章在今天10点第一次发表在一个博客或者网站上。会有什么结果呢?
搜索引擎蜘蛛来到这个博客或者网站,发现这个页面,分析内容,放入数据库,并且被确定为首次发现,这肯定就是原创了!
那么这个收录与判断的过程中间有几个细节方面问题:
1、必要条件
——假如这个网站没有被收录,这篇文章会认为是原创吗?
——当然不是!因为它根本不可能出现在搜索数据库里!
——如何让它成为原创内容?
——第一个条件,网站必须被搜索引擎收录。
——假如这个网站收录了,但是不经常更新呢?
——很简单,如果不经常更新,发表的文章到收录的时候也会认为是原创的。
2、转载与采集
——如果文章被转载了呢?
——如果文章被转载,那么看转载这篇文章的站更新周期与首次发表站的更新周期哪个更快。
——不太明白更新周期。
——比如在A站发表,B站转载,如果蜘蛛先访问了A站,发现了文章,再来到B站发现了文章,很明显的,原创权重归A站。
——采集的情况是否符合这种情况?
——是的,采集的情况一样。如果B采集A,但B收录比A早,B就可能变成原创喽!
3、访问时间
——如果蜘蛛先访问了B站呢?
——当然权重给B站,一般的情况下都会这样!
——如果B站转载的文章带了A站的原文章页面链接呢?
——这就很明白了,刚收录的时候,如果排名,两条结果一起出现,有可能还是B站的排名好一点。
当然,文章转载次数多了以后,A站的链接越多,对A站的文章越有好处,排名会慢慢变成A站在前面。
——如果另外转载的文章带的是B站页面的链接呢?
——这种情况就搞笑了,给搜索引擎开了个玩笑,但它们如果判断不好,就变成了一个链接流行度的比赛了。
不过,如果都有很多外部链接,并且相差不大,那么判断的规则应该回到原点,谁先被收录谁就是原创。
4、快照日期
——快照日期显示时间最早的,一般就是原创了吧!
——不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。
但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!
——还有其它的可能吗?
——有,一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站的结果放出来了,而A站还在数据库里。
所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。

这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎的信任度并不高的时候。不过只要是A站先被访问到的,原创权还是A站的,这是最难分出来的情况,因为我们不知道蜘蛛先访问哪个站,除非你知道两个站的网站空间日志内容,能看到搜索引擎对两个页面的访问时间。
来自于:博赚站长(http://blog.fanyongzhuji.com),转载请注明!
5、伪原创
——伪原创也会被认为是原创?
——大多时候是这样的,搜索引擎蜘蛛智力相当于三岁小孩子一样,不能明确分别这些东西,因为它的思维太程式化了。如果你的标题改过,文章的段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复的,但它也不能因为这些而将这篇文章确认为是转载!当然,随着搜索引擎程式设计的提高,应该会有一个相似度的东西出来,比如文字内容相似度超过百分之几就会被认为是转载。
这样分析下来,相信大家应该了解了吧。这只是站长自己的看法,希望大家吸收自己想要的东西,不认同的也来提下自己的意见!
另外提几个建议:
1、如果你的站是新站,权重不高,如何让蜘蛛首页找到你的页面并放入数据库?其实很简单:用网摘、百度收藏这些工具让蜘蛛更快的找到你的页面!
2、大家都有过建议,就是加上自己的版权及内容页面的地址,别人采集的时候你就爽了,收录虽然不会快,但最后链接多了,你依然是原创内容。
3、发表文章等到自己收录以后再去其它的站点进行发表,同时加上自己的原文地址,这种办法很有保障!大站被采的机率很大!

扫描二维码推送至手机访问。

版权声明:本文由博赚恋吧资源站发布,如需转载请注明出处。

本文链接:https://432l.com/post/1089.html

标签: 站长工具
分享给朋友:

相关文章

国内几个常用的网站流量统计工具比较

     中国站长统计(www.cnzz.com)  优点:1、广告较少      2、能分析国外的IP      3、能分析不常用的屏幕分辨率     缺点:1、来路统计和搜索引擎统计不能正确统计,形同虚设      2、安装后,网页显示速度有所降低,浏览器告警”阻挡cookie发送”      3、很多统计项未标明是针对PV统计还...

推荐----一个成功的站长需记住的10个关键词

有个个人网站容易,但如何管理和运营是难题,下面跟大家分享一下做一个成功的站长需要记住的10个关键词:  第一个关键词:发现,就是说要善于寻找和发现机会。机不可失,失不再来,机会在哪里?中国有句俗语,叫“缺什么,补什么”,也就是看互联网上还需要什么,今天需要什么,将来需要什么。  第二个关键词:量力,就是要根据自己的实力对自己的网站进行准确的定位。限于资金、技术、人员等诸多因...

喜闻Clicki重新开放注册!

由于种种原因,Clicki停止开发一年多,也停止注册一年多。这一年多,不断有朋友在关注,在论坛、邮件、QQ都有很多朋友问我。对此我真的很惭愧。无论如何,经过一番努力,新版Clicki终于在2009年7月29日重新开放注册。暂时没有上线全部功能,只是开放了实时显示来源的插件,其他功能将陆续开放。再次感谢大家支持!站长以前用的是Feedjit,http://feedjit.com,用的也是相当的不错!...

如何使用新浪微博进行博客推广

     新浪微博最近可是很红啊!作为Twitter的copy品(姑且可以这样说吧),说起twitter恐怕没有人不知道吧,由于Twitter的影响力和使用者逐步扩大,通过Twitter来推广自己的博客是一件很容易的事,可是由于人人都知道的原因,Twitter‘、叽歪等类似的微博客系统都集体的歇菜了,想想新浪这么大的背景,“围脖”的...

门户通之完美去弹窗+伸缩广告的代码加入方法(不占广告位)

9月14号门户通正式推出产品推广联盟,一但审核通过将人工帮你去掉广告,但是由于推出的广告种类很少,很占网站广告位,在这里公布一个既合法又不占用你任何广告位的代码 ,这是门户通论坛里一会会员提供的,还被管理员置为精华的文章,具体加入代码那需要你更具自己的需要改成你自己的,相信这个很简单吧! 演示地址:http://www.9zys.com<tr><td>&...

Z-blog的转移和备份问题的解决办法

俗话说,“不怕一万,就怕万一”,网络毕竟是虚幻的,“数字灾难”随时都可能发生。一旦有有不测风云,如病毒袭击、服务器瘫痪、自己误操作等都有可能使你驾设在虚拟空间的博客瞬间消失殆尽。其实,只要你养成经常备份的习惯,这些突发事件对你来说就没什么大不了的。那么如何对Z-blog进行备份呢?首先,建议你现在就开始,在自己的电脑硬盘新建一个博客文件夹,然后将虚拟空间里的全部blog文件(除了post目录外)下...

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。