跟踪链接
哈尔滨网站优化为了抓取网上尽量多的页面,搜索引擎蜘蛛会跟踪页面上的链接,从一个页面爬到下一个页面, 就好像蜘蛛在蜘蛛网上爬行那样,这也就是搜索引擎蜘蛛这个名称的由来。
整个互联网是由相互链接的网站及页面组成的。从理论上说,蜘蛛从任何一个页面出发,哈尔滨网站优化顺着 链接都可以爬行到网上的所有页面。当然,由于网站及页面链接结构异常复杂,蜘蛛需要采取一定的爬行策略才能遍历网上所有页面。
最简单的爬行遍历策略分为两种,一是深度优先,二是广度优先。
所谓深度优先指的是蜘蛛沿着发现的链接一直向前爬行,哈尔滨网站优化直到前面再也没有其他链接,然后返 回到第一个页面,沿着另一个链接再一直往前爬行。
|