httpclient返回值中文乱码问题解决方法

最新推荐文章于 2025-04-16 09:58:08 发布

程序员悟空

最新推荐文章于 2025-04-16 09:58:08 发布

阅读量1.1w

点赞数 1

分类专栏：计算机知识

计算机知识专栏收录该内容

5 篇文章

订阅专栏

前几天，在抓取某网站的信息时(http://www.99sj.com/Price/Price/Default.aspx)，第一次碰到了这种应用下的乱码问题。于是上网查了一下，提供的解决办法大致有两种：

１>　　private static final String CONTENT_CHARSET = "GBK";

　httpClient.getParams().setContentCharset("UTF-8");

　or

　httpClient.getParams().setParameter(HttpMethodParams.HTTP_CONTENT_CHARSET,ＣONTENT_CHARSET);

2>　　private static final String CONTENTTYPE = " text/html;charset=GBK";

　　getMethod.setRequestHeader("Content-Type", CONTENTTYPE);

测试了，没有任何效果（换成UTF-8也不行）。也用了String result = newString(pageSrc.getBytes("UTF-8"),"GBK")，依然无效。

在焦头烂额时想到了以前在学校时经常用的一句话：找问题要会追根溯源。仔细想想，字符串里面的文本内容也是通过文件流获取的，既然转换字符串字符编码不起作用，那可以设置文件流的默认编码吗？查了jdk，是可行的。

private static final String CHARSET = "UTF-8";

InputStream ins = getMethod.getResponseBodyAsStream();

//按指定的字符集构建文件流
BufferedReader br = new BufferedReader(newInputStreamReader(ins,CHARSET));
StringBuffer sbf = new StringBuffer();
String line = null;
while ((line = br.readLine()) != null)
{
sbf.append(line);
}

br.close();

问题解决，^_^。这里的CHARSET要根据实际情况设置

http://blog.sina.com.cn/s/blog_a1b205bb0101aer6.html