WebMagic是java上面经常的需要的一款爬虫类型的工具了,现在就可以试试最新的0.7.3版本,功能以及使用上面都是完全的免费的,欢迎大家试试!

WebMagic中文版功能
WebMagic是一个简单灵活的Java爬虫框架。基于WebMagic,你可以快速开发出一个高效、易维护的爬虫。webmagic采用完全模块化的设计,功能覆盖整个爬虫的生命周期(链接提取、页面下载、内容抽取、持久化),支持多线程抓取,分布式抓取,并支持自动重试、自定义UA/cookie等功能。
WebMagic0.7.3更新内容
本次更新增加了Downloader模块的一些功能。
#609修复HttpRequestBody没有默认构造函数导致无法反序列化的bug。
#631HttpRequestBody的静态构造函数不再抛出UnsupportedEncodingException受检异常。
#571Page对象增加bytes属性,用于获取二进制数据。下载纯二进制页面时,请设置request.setBinarayContent(true),这样对于二进制内容不会尝试转换为String,减小开销。
#629在HttpUriRequestConverter中会自动对一些导致URI异常的字符进行转移或过滤。
#610自动识别编码时,可以识别Content-Type中charset为大写的情况。
#627支持为Request单独设置页面编码,兼容同一站点多种编码方式的情况。
#613Page对象增加charset属性,其值为request/site中设置的charset,或者为自动检测的charset(未定义时)。
#606升级jsonpath到2.4.0
#608升级jsoup到1.10.3
WebMagic常见问题
(1)由于我这个爬虫的抓取有分页,而且它的分页通过js跳转的,抽取出来感觉有点麻烦,我想直接得到所有的信息,发现可以通过输入url地址请求得到所有的信息(这是网站的一个小问题,它没有设置每页数据记录条数的范围),但是需要登录才可以进行url地址的访问,就要使用cookie模拟登录。卡车司机弯路驾驶(Offroad Trucker Muddy Car Drive)1.0 安卓版
(2)下面分析有关登录信息的cookie,我使用的是chrome,点击如图位置,会看到此网站的cookie,(如果已经访问了一段时间了,可以清除所有cookie然后重新登录再访问,否则可能会有很多的cookie,分析起来不方便),由于只有5个cookie,直接加上就可以访问了
展开

面具magisk中文模块大全-面具Magisk神器8.0.4【完整数据包+卸载器】
桌面日程安排软件-如意吧桌面日程安排566A 绿色免费版
文本计算工具-浅藏文本计算器v1.1绿色版
苏州租房合同模板-苏州房屋租赁合同范本doc免费下载【4份】
右键菜单管理工具(Context Menu Tuner)1.1 绿色中文版
百度输入法番外版二次元输入法皮肤下载-百度输入法番外版3.5.2133.0官网最新版
airmeasure ar下载-airmeasure增强现实测量套件1.6 最新手机版
神之大陆至尊特权版下载-神之大陆送1000神卡连抽版1.0
电脑语音控制软件-电脑智能语音控制软件v1.0 官方安装版
全民象棋免费下载安装-全民象棋官方正版v5.10.13.0 最新版
jdk8u341下载-Java SE Development Kit 8 (JDK)v8.0.341 官方版
画线魔幻涂鸦红包版下载-画线魔幻涂鸦红包游戏1.0赚钱版
疯狂城市犯罪1.0安卓版
PHPMaker 2017破解版-PHPMaker 2017(PHP代码自动生成工具)免费破解版
增值税发票税控开票软件V2.0.12 税控盘版
飞书搜官方版APP下载-飞书搜1.0 最新版
萌璃影音下载-萌璃播放器(B站视频下载器)3.0 绿色版
AutoCAD Plant 3D 2014官方版下载-AutoCAD Plant 3D 2014简体中文版【附教程注册机】
桌面美化工具下载-桌面美化大师1.5.188 官方免费版
Xbox Game Pass app官方app下载-Xbox Game Pass手机版(Xbox云游戏)2312.29.1129 官方版