当前位置:首页 > SEO优化 > 正文内容

Google爬虫:不仅索引链接,还可以运行js代码

admin16年前 (2010-06-26)SEO优化682
一直以来Google的搜索爬虫就具有阅读JavaScript代码的功能,但是多年以来我们一直都不清楚Google的爬虫是否真正理解了其正在抓取的东西或者说它仅仅只是在易于理解的数据结构中对各种链接进行呆板的检索。本周五,一位Google的发言人向《福布斯》确认Google所作的远远超过对js代码的简单分析。这位发言人表示:“Google能够分析并理解某些JavaScript”。         Google的表述让我们意识到其爬虫所作的工作也许不仅仅只是获得对页面的相关链接,还能够像人一样与各类程序发生互动——发现Bing这类搜索引擎所不能发现的网络世界。而这意味着,Google重新定义了搜索引擎。在Google的搜索结果里面只有很少的js代码,而且Google也将这种js代码的解释功能做了很多保留。比如在Google站点搜索(Google's Site Search)的文档显示其不能够索引带有js代码的内容。一本关于索引的入门教材这样写道:它(Google爬虫)“不能够处理带有富媒体的内容或者是动态网页”。仔细检查服务器日志中的记录我们便可以发现Google现在索引那些并不是直接包含在js代码里面的链接,Google的爬虫只有确定自己能够运行部分代码的时候才能明白整段代码到底是什么意思。         Mark Drummond,一家独立搜索引擎公司Wowd的首席执行官(我们在今年之前的杂志中采访过他)在一封邮件中告诉我们理解js代码“是一个非常深刻、难度极大和一场经典的计算科学难题。”他解释道Google的努力在于它能够发现js代码在网页中是否存在停止运行的情况。他表示“停止运行的问题是无法判定的”,他说迄今为止还没有已知的算法能够在任何程序的任何时间点告诉我们该程序是否陷入了死循环,而且数学上已经证明了这一点。Drummond自己的公司通过人工的方式检索其索引并标明是否有可能简化这个复杂的问题,同时判断一个网络程序是否向另外的程序发起了数据请求。也许,这正是Google现在在做的事情。         另一位同Google接近的搜索引擎人士也认同Drummond关于理解js代码复杂性的看法。他认为用一个程序去分析另一个程序是很困难的事情,执行js代码几乎是现阶段能够做到的极限了。         而Google在六月发布的改进版搜索算法(即Caffeine)似乎开始能够理解部分js代码了。如果这是真的,那么Google的工程师已经教会了其爬虫如何执行部分js代码。这真是一大突破!

扫描二维码推送至手机访问。

版权声明:本文由博赚恋吧资源站发布,如需转载请注明出处。

本文链接:https://432l.com/post/3034.html

标签: SEO优化
分享给朋友:

相关文章

几招帮助你快速发现有价值域名

        域名投资不需要花费太多时间和精力,所以很多人在寻找域名的过程中,感觉不是那么好找。下面站长为大家介绍一些工具,会帮助大家,让你更快的发现一个对你来说具有价值的域名。Domain Hacks - 提供域名Hack服务,类似于del.icio.us一样,把单词delicious(中文为”美味的&rdquo...

Z-blog的转移和备份问题的解决办法

俗话说,“不怕一万,就怕万一”,网络毕竟是虚幻的,“数字灾难”随时都可能发生。一旦有有不测风云,如病毒袭击、服务器瘫痪、自己误操作等都有可能使你驾设在虚拟空间的博客瞬间消失殆尽。其实,只要你养成经常备份的习惯,这些突发事件对你来说就没什么大不了的。那么如何对Z-blog进行备份呢?首先,建议你现在就开始,在自己的电脑硬盘新建一个博客文件夹,然后将虚拟空间里的全部blog文件(除了post目录外)下...

三大博客程序比较:WordPress, b2evolution和MovableType

现在架设博客网站可以使用的程序太多了,以至于要做一个全面的比较几乎都是个不可能的任务了。不过使用最多的三个博客程序大家可能都知道,那就是WordPress、b2evolution以及MovableType。其中的WordPress由于其开源的性质以及众多插件、主题的支持,在国内现在已经是一个炙手可热的博客建站程序了。  现在WordPress可以说是业界的领导者了,而b2evolution则是既可...

分享7 款强大的 Firefox SEO 插件

SEO for Firefox这是一款标准的 SEO 工具。当你在 Google 上搜索时,该插件会给你大量的额外的信息。 你能看到网站的 PR, 年龄,Yahoo 反链以及其他能帮助你对竞争对手进行分析的信息。同时提供了到另一款名为 SEO X 光的小工具的通路。这个小工具会给你展示网站的 meta 信息,H 标签的使用,和页面的内链外链情况。Firefox上 针对 SEO 的插件很多,但也难怪...

中英文RSS提交站点,快速提高流量

RSS是个好东西啊!整理一些中文的收录Blog的站点。大家可以把自己Blog的RSS提交,让更多人知道。中文RSS搜索引擎http://www.feedss.comhttp://www.feedss.com/add_channel.html中文Blog、RSS搜索http://www.feedsearch.nethttp://www.feedsearch.net/submit.htmCNBlogh...

提高网站用户体验的三种方法

做网站的人都知道,要想一个网站在搜索引擎中获得一个好的权重,不仅仅要做好一些基本的SEO优化,比如说经常用到的title,keywords,description以及做好相应的推广之外,个人认为,目前更为重要的就是提升用户访问你的网站的深度。  有人会问,什么是用户访问网站的深度呢?很简单,就是用户在一次浏览你的网站的过程中浏览了你的网站的页数。可想而知,如果他一次性的浏览了你的网站的页数越多,那...

评论列表

刘晔
16年前 (2010-06-29)

学习一下了。。。

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。