crawler4j抓取页面使用jsoup解析html时的解决方法_Java教程-查字典教程网

导航

手机

客服中心

投稿赚钱

免费注册

首页

系统安装
WindowsXP 安装基础教程 Ubuntu 安装基础教程 Gparted 分区编辑器操作基础 VMware 虚拟机基础入门教程 VirtualBox 虚拟机基础教程 360安全卫士基础入门教程操作系统 windows10安装教程 windows8安装教程 windows7安装教程 U盘教程 windows2003教程 Linux教程苹果MAC教程其他教程
办公制作
Word 基础入门教程 Excel 基础入门教程 PowerPoint 基础入门教程蒙泰瑶光课件制作基础 OpenOffice.org Writer OpenOffice.org Calc OpenOffice.org Impress 高效办公
图像动画
Photoshop CS 基础入门教程 GIMP 基础入门教程 3DS Max 8.0 基础入门教程 Flash 8.0 基础入门教程 Flash 8.0 脚本基础教程 Ulead Gif Animator 教程图形图像 Painter基础教程 isee基础教程可牛影像基础教程光影魔术手基础教程 Freehand基础教程
音频视频
Goldwave 基础入门教程视频编辑基础入门教程影视制作媒体工具快手抖音
编程开发基础
Visual C++基础入门教程 C++ 基础入门教程 C 基础入门教程 CSS 基础入门教程 VB 基础入门教程 QBasic基础入门教程 HTML 音画帖基础入门教程 Nvu 网站制作基础 FrontPage 网站制作基础 Kompozer 网站制作基础 Kompozer 帮助文档 KompoZer user guide Poedit 翻译基础教程 Ubuntu 命令行基础教程谷歌网站管理员工具操作基础 C#基础教程
网络应用
QQ 聊天基础入门教程 Firefox3 基础入门教程 Discuz! 和 PW 论坛安装教程电子邮件基础入门教程论坛新手基础入门教程其他教程... 网络知识网络基础知识网络应用技术网络故障处理下载工具
电脑基础
iphone教程安卓教程手机软件教程手机技巧微信教程手机知识刷机教程
教学设计
2008-2009学年 2009-2010学年 2010-2011学年 2011-2012学年 2012-2013学年 2013-2014学年 2014-2015学年

当前位置：查字典教程网 >编程开发 >Java >crawler4j抓取页面使用jsoup解析html时的解决方法

crawler4j抓取页面使用jsoup解析html时的解决方法

摘要：crawler4j对已有编码的页面抓取效果不错，用jsoup解析，很多会jquery的程序员都可以操作。但是，crawler4j对respo...

crawler4j对已有编码的页面抓取效果不错，用jsoup解析，很多会jquery的程序员都可以操作。但是，crawler4j对response没有指定编码的页面，解析成乱码，很让人烦恼。在找了苦闷之中，无意间发现一年代已久的博文，可以解决问题，修改 Page.load() 中的 contentData 编码即可，这让我心中顿时舒坦了很多，接下来的问题都引刃而解了。

复制代码代码如下:

public void load(HttpEntity entity) throws Exception {

contentType = null;

Header type = entity.getContentType();

if (type != null) {

contentType = type.getValue();

}

contentEncoding = null;

Header encoding = entity.getContentEncoding();

if (encoding != null) {

contentEncoding = encoding.getValue();

}

Charset charset = ContentType.getOrDefault(entity).getCharset();

if (charset != null) {

contentCharset = charset.displayName();

}else{

contentCharset = "utf-8";

}

//源码

//contentData = EntityUtils.toByteArray(entity);

//修改后的代码

contentData = EntityUtils.toString(entity, Charset.forName("gbk")).getBytes();

}

【crawler4j抓取页面使用jsoup解析html时的解决方法】相关文章：

★ java 页面url传值中文乱码的解决方法

★ Eclipse下使用ANT编译提示OutOfMemory的解决方法

★ Java解析XML的四种方法详解

★ 在java中使用dom解析xml的示例分析

★ java正则表达式提取数字的方法实例

★ 解析Java线程同步锁的选择方法

★ java使用xpath和dom4j解析xml

★ java中Filter过滤器处理中文乱码的方法

★ 浅析打开eclipse出现Incompatible JVM的解决方法

★ java dom4j解析xml用到的几个方法

上一篇： java生成json数据示例

下一篇： java将图片分割为几个部分示例

相关阅读

更多>>

网友关注

更多>>

网友最新关注视频

更多>>

精品推荐

系统安装

办公制作

图像动画

音频视频

编程开发基础

网络应用

数码

摄影

平面设计

ps

网页设计

室内设计

三维

电脑

电子商务

建站

编程开发

脚本专栏

操作系统

实用技巧

软件教程

网络

硬件教程

分类导航

系统安装

办公制作

图像动画

音频视频

编程开发基础

网络应用

电脑基础

数码

摄影

平面设计

ps

网页设计

室内设计

三维

电脑

电子商务

建站

编程开发

脚本专栏

操作系统

实用技巧

软件教程

网络

硬件教程

视频教程

教学设计

编程开发子分类

最新Java学习

热门Java学习