爬行器

基本信息

爬行器（Spider）指在 Web 上漫游，寻找要添加进搜索引擎索引中的列表。爬行器有时也称为 Web 爬行榜（Webcrawler）或机器人。针对有机列表优化页面也就是为了吸引爬行器的注意。

网络爬虫，也称为蜘蛛程序（Spider）。网络爬虫是一个自动提取网页的程序，是搜索引擎的重要组成部分。作为爬虫来讲，就是尽可能多和快的给搜索引擎输送网页，实现强大的数据支持。

网络爬虫是通过网页的链接地址来寻找网页，从网站某一个页面（通常是首页）开始，读取网页的内容，找到在网页中的其他链接地址，然后通过这些链接地址寻找下一个网页，这样一直循环下去，直到把这个网站所有的网页都抓取完为止。

如果把整个互联网当成一个网站，那么网络爬虫就可以用这个原理把互联网上所有的网页都抓取下来