章节目录第十一章数据海洋和爬虫_绝对掌控_玄幻小说

冒药相关的数据信息，我该怎么办？

    正是这种需求催生了搜索引擎，搜索引擎可以帮助你快找到目标，它就像一个找路指南一样，你只要告诉它想去哪，这个目的地大概什么特征，它就会帮助你找到无数个可能合适的目的地，并且把对方的url提供给你。

    搜索引擎每天的访问量都是海量的，每一秒同时并的搜索请求都是数以十万计的，在这么多请求面前，如果来一个请求它搜一遍互联网，这肯定是不现实的，不仅度慢效率低，而且仅仅这类搜索请求就足让整个国际互联网陷入拥堵状态。

    为了解决这个问题，搜索引擎就有了它特有的工作模式，它先尽可能多的将数据海洋里的信息全部找出来，然后存储在自己的服务器群组中，一旦有了搜索请求，它只要在自己的服务器里进行检索就行了。

    而帮助搜索引擎完成找这个动作的就是爬虫。

    因为国际互联网中的信息节点都是相互关联的，是网状联系的，每个节点上都会有很多个url。所以爬虫的工作模式就是遍历，当它开始工作时，它会以一个信息节点为，然后挨个访寻与这个节点相连的所有节点，当下一层节点还有url链接时，它就不断访问下去，直到将所有url遍历一次才算

章节目录 第十一章 数据海洋和爬虫(3/5)

章节目录第十一章数据海洋和爬虫(3/5)