1. XenForo 1.5.14 中文版——支持中文搜索!现已发布!查看详情
  2. Xenforo 爱好者讨论群:215909318 XenForo专区

新闻 WebMagic 0.7.3 版本发布,Java 爬虫框架 下载

本帖由 漂亮的石头2017-07-31 发布。版面名称:软件资讯

  1. 漂亮的石头

    漂亮的石头 版主 管理成员

    注册:
    2012-02-10
    帖子:
    488,009
    赞:
    47
    WebMagic是一个简单灵活的Java爬虫框架。基于WebMagic,你可以快速开发出一个高效、易维护的爬虫。

    本次更新增加了Downloader模块的一些功能。


    • #609 修复HttpRequestBody没有默认构造函数导致无法反序列化的bug。


    • #631 HttpRequestBody的静态构造函数不再抛出UnsupportedEncodingException受检异常。


    • #571 Page对象增加bytes属性,用于获取二进制数据。下载纯二进制页面时,请设置request.setBinarayContent(true),这样对于二进制内容不会尝试转换为String,减小开销。


    • #629 在HttpUriRequestConverter中会自动对一些导致URI异常的字符进行转移或过滤。


    • #610 自动识别编码时,可以识别Content-Type中charset为大写的情况。


    • #627 支持为Request单独设置页面编码,兼容同一站点多种编码方式的情况。


    • #613 Page对象增加charset属性,其值为request/site中设置的charset,或者为自动检测的charset(未定义时)。


    • #606 升级jsonpath到2.4.0


    • #608 升级jsoup到1.10.3
    WebMagic 0.7.3 版本发布,Java 爬虫框架下载地址
     
正在加载...