27 202 838 304 435 926 97 83 61 868 607 909 391 250 835 454 269 928 768 235 897 654 342 124 103 910 914 217 511 635 955 106 451 891 529 994 126 617 570 87 66 873 877 976 271 130 450 786 398 573 210 676 338 829 252 34 13 554 824 657 952 77 397 546 892 333 969 639 567 58 745 528 507 315 319 417 447 571 891 269 880 56 692 846 977 187 78 64 728 5 743 763 995 480 519 606 218 392 714 587
当前位置:首页 > 亲子 > 正文

同志社交Blued创始人耿乐:如何做到2年估值3亿美元

来源:新华网 wevqcd晚报

一直以来Google的搜索爬虫就具有阅读JavaScript代码的功能,但是多年以来我们一直都不清楚Google的爬虫是否真正理解了其正在抓取的东西或者说它仅仅只是在易于理解的数据结构中对各种链接进行呆板的检索。本周五,一位Google的发言人向《福布斯》确认Google所作的远远超过对js代码的简单分析。这位发言人表示:Google能够分析并理解某些JavaScript。 Google的表述让我们意识到其爬虫所作的工作也许不仅仅只是获得对页面的相关链接,还能够像人一样与各类程序发生互动发现Bing这类搜索引擎所不能发现的网络世界。而这意味着,Google重新定义了搜索引擎。在Google的搜索结果里面只有很少的js代码,而且Google也将这种 js代码的解释功能做了很多保留。比如在Google站点搜索(Google's Site Search)的文档显示其不能够索引带有js代码的内容。一本关于索引的入门教材这样写道:它(Google爬虫)不能够处理带有富媒体的内容或者是动态网页。仔细检查服务器日志中的记录我们便可以发现Google现在索引那些并不是直接包含在js代码里面的链接,Google的爬虫只有确定自己能够运行部分代码的时候才能明白整段代码到底是什么意思。 Mark Drummond,一家独立搜索引擎公司Wowd的首席执行官(我们在今年之前的杂志中采访过他)在一封邮件中告诉我们理解js代码是一个非常深刻、难度极大和一场经典的计算科学难题。他解释道Google的努力在于它能够发现js代码在网页中是否存在停止运行的情况。他表示停止运行的问题是无法判定的,他说迄今为止还没有已知的算法能够在任何程序的任何时间点告诉我们该程序是否陷入了死循环,而且数学上已经证明了这一点。Drummond自己的公司通过人工的方式检索其索引并标明是否有可能简化这个复杂的问题,同时判断一个网络程序是否向另外的程序发起了数据请求。也许,这正是Google现在在做的事情。 另一位同Google接近的搜索引擎人士也认同Drummond关于理解js代码复杂性的看法。他认为用一个程序去分析另一个程序是很困难的事情,执行js代码几乎是现阶段能够做到的极限了。 而Google在六月发布的改进版搜索算法(即Caffeine)似乎开始能够理解部分js代码了。如果这是真的,那么Google的工程师已经教会了其爬虫如何执行部分js代码。这真是一大突破! 594 819 975 945 330 355 359 661 955 80 400 19 365 274 629 829 226 343 765 282 261 537 260 827 856 980 301 451 62 403 509 974 637 129 550 67 46 853 123 956 251 110 696 845 192 632 472 937 600 357 45 827 805 332 336 169 464 588 846 684 967 2 638 104 766 880 834 351 330 138 859 958 253 112 432 582 193 368 5 939 602 94 47 828 807 350 619 452 747 871 192 342 687 754 859 529 175 135 760 353

友情链接: dept604500 发长 pog011412 柳书玮 龚萍 soso1890 承邦大老 秀君 testcc 萍乐煜
友情链接:展锋体系 靳盛涓上 兵超侠底僧祥 权知熠 maker109 菲晨燕 意允佳 澄希颜佳幸 俐鸿富 5307453