搜索引擎对于原创文章的确定标准分析_第1页
搜索引擎对于原创文章的确定标准分析_第2页
搜索引擎对于原创文章的确定标准分析_第3页
免费预览已结束,剩余1页可下载查看

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

搜索引擎对于原创文章的确定标准分析

首先我们明确两个概念:原创与伪原创原创:简单地理解就是第一次在网络上发表的内容。伪原创:就是对原创进行的第二次或者第N次经过修改的转载发表。比如修改标题,增加摘要,转载不完整内容等等。搜索引擎对于原创的判断是如何进行的呢?一般来讲有以下几个方面的因素决定:1、快照日期。2、蜘蛛抓取日期。3、页面外链的多少。4、文章修改的程度。举例:如果一篇标题为《搜索引擎如何确定你的就是原创内容》的文章在今天10点第一次发表在一个博客或者网站上。会有什么结果呢?搜索引擎蜘蛛来到这个博客或者网站,发现这个页面,分析内容,放入数据库,并且被确定为首次发现,这肯定就是原创了!那么这个收录与判断的过程中间有几个细节方面问题:1、必要条件——假如这个网站没有被收录,这篇文章会认为是原创吗?——当然不是!因为它根本不可能出现在搜索数据库里!——如何让它成为原创内容?——第一个条件,网站必须有被搜索引擎收录。——假如这个网站收录了,但是不经常更新呢?——很简单,如果不经常更新,发表的文章到收录的时候也会认为是原创的。2、转载与采集——如果文章被转载了呢?——如果文章被转载,那么看转载这篇文章的站更新周期与首次发表站的更新周期哪个更快。——不太明白更新周期。——比如在A站发表,B站转载,如果蜘蛛先访问了A站,发现了文章,再来到B站发现了文章,很明显的,原创权重归A站。——采集的情况是否符合这种情况?——是的,采集的情况一样。如果B采集A,但B收录比A早,B就可能变成原创喽!3、访问时间——如果蜘蛛先访问了B站呢?——当然权重给B站,一般的情况下都会这样!——如果B站转载的文章带了A站的原文章页面链接呢?——这就很明白了,刚收录的时候,如果排名,两条结果一起出现,有可能还是B站的排名好一点。当然,文章转载次数多了以后,A站的链接越多,对A站的文章越有好处,排名会慢慢变成A站在前面。——如果另外转载的文章带的是B站页面的链接呢?——这种情况就搞笑了,给搜索引擎开了个玩笑,但它们如果判断不好,就变成了一个链接流行度的比赛了。不过,如果都有很多外部链接,并且相差不大,那么判断的规则应该回到原点,谁先被收录谁就是原创。4、快照日期——快照日期显示时间最早的,一般就是原创了吧!——不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!——还有其它的可能吗?——有,一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站的结果放出来了,而A站还在数据库里。所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎的信任度并不高的时候。不过只要是A站先被访问到的,原创权还是A站的,这是最难分出来的情况,因为我们不知道蜘蛛先访问哪个站,除非你知道两个站的网站空间日志内容,能看到搜索引擎对两个页面的访问时间。5、伪原创——伪原创也会被认为是原创?——大多时候是这样的,搜索引擎蜘蛛智力相当于三岁小孩子一样,不能明确分别这些东西,因为它的思维太程式化了。如果你的标题改过,文章的段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复的,但它也不能因为这些而将这篇文章确认为是转载!当然,随着搜索引擎程式设计的提高,应该会有一个相似度的东西出来,比如文字内容相似度超过百分之几就会被认为是转载。这样分析下来,相信大家应该了解了吧。只是核桃自己的看法,希望大家吸收自己想要的东西,不认同的了也来提下自己的意见!另外提几个建议:1、如果你的站是新站,权重不高,如何让蜘蛛首页找到你的页面并放入数据库?其实

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论