日韩久久久精品,亚洲精品久久久久久久久久久,亚洲欧美一区二区三区国产精品 ,一区二区福利

crawler4j - Open Source Web Crawler for Java

系統 2806 0

crawler4j - Open Source Web Crawler for Java - Google Project Hosting

Crawler4j is an open source Java crawler which provides a simple interface for crawling the Web. You can setup a multi-threaded web crawler in 5 minutes!

NOTE: version 3.0 is deprecated and should not be used. Please use the latest 3.3 version.

Sample Usage

You need to create a crawler class that extends WebCrawler . This class decides which URLs should be crawled and handles the downloaded page. The following is a sample implementation:

      
        public
      
      
      
      
        class
      
      
      
      
        MyCrawler
      
      
      
      
        extends
      
      
      
      
        WebCrawler
      
      
      
      
        {
      
      
        

? ? ? ?
private final static Pattern FILTERS = Pattern . compile ( ".*(\\.(css|js|bmp|gif|jpe?g"
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?
+ "|png|tiff?|mid|mp2|mp3|mp4"
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?
+ "|wav|avi|mov|mpeg|ram|m4v|pdf"
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?
+ "|rm|smil|wmv|swf|wma|zip|rar|gz))$" );

? ? ? ?
/**
? ? ? ? ?* You should implement this function to specify whether
? ? ? ? ?* the given url should be crawled or not (based on your
? ? ? ? ?* crawling logic).

crawler4j - Open Source Web Crawler for Java - Google Project Hosting


更多文章、技術交流、商務合作、聯系博主

微信掃碼或搜索:z360901061

微信掃一掃加我為好友

QQ號聯系: 360901061

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描下面二維碼支持博主2元、5元、10元、20元等您想捐的金額吧,狠狠點擊下面給點支持吧,站長非常感激您!手機微信長按不能支付解決辦法:請將微信支付二維碼保存到相冊,切換到微信,然后點擊微信右上角掃一掃功能,選擇支付二維碼完成支付。

【本文對您有幫助就好】

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描上面二維碼支持博主2元、5元、10元、自定義金額等您想捐的金額吧,站長會非常 感謝您的哦!!!

發表我的評論
最新評論 總共0條評論
主站蜘蛛池模板: 桃园县| 赣州市| 榆中县| 灌云县| 喀喇| 济源市| 卓尼县| 广水市| 乃东县| 特克斯县| 老河口市| 遵化市| 华池县| 高邑县| 龙门县| 南充市| 上犹县| 广汉市| 博爱县| 西盟| 呼伦贝尔市| 西贡区| 都匀市| 韶山市| 化隆| 秦皇岛市| 哈巴河县| 新营市| 云阳县| 汽车| 固原市| 民勤县| 湛江市| 丹江口市| 霞浦县| 罗江县| 文山县| 怀远县| 赤峰市| 扶沟县| 保定市|