虫虫首页| 资源下载| 资源专辑| 精品软件
登录| 注册

Larbin

  • Larbin互联网蜘蛛索引系统

    Larbin互联网蜘蛛索引系统

    标签: Larbin 互联网 索引

    上传时间: 2014-10-12

    上传用户:xinyuzhiqiwuwu

  • Larbin是一种开源的网络爬虫/网络蜘蛛

    Larbin是一种开源的网络爬虫/网络蜘蛛,由法国的年轻人 Sébastien Ailleret独立开发。Larbin目的是能够跟踪页面的url进行扩展的抓取,最后为搜索引擎提供广泛的数据来源。   Larbin只是一个爬虫,也就是说Larbin只抓取网页,至于如何parse的事情则由用户自己完成。另外,如何存储到数据库以及建立索引的事情 Larbin也不提供。 latbin最初的设计也是依据设计简单但是高度可配置性的原则,因此我们可以看到,一个简单的Larbin的爬虫可以每天获取500万的网页,实在是非常高效。

    标签: Larbin 开源 网络爬虫 网络

    上传时间: 2017-03-02

    上传用户:lili123