至于在tomcat中更改URI-Encoding及使用过滤器,我估计是用来更改将字节流转成字符串的编码
tomcat的乱码问题
Posted 陈灿坚
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了tomcat的乱码问题相关的知识,希望对你有一定的参考价值。
String filename=request.getParameter("filename"); filename=new String(filename.getBytes("iso8859-1"),"utf-8"); 解释第二句,用意是什么?为什么这样做?原理是什么?
1、你这种情况往往是在http请求get传输参数方式的时候,web容器是tomcat,而tomcat的默认编码是iso8859-1。 2、若为iso8859-1,而你的项目非该编码在接收到中文类字符时,即会出现乱码。 3、解决方法,即是将iso8859-1转化为项目编码如gbk或utf-8,就解决了传输过程的中文乱码问题。
-
不清楚什么时候该这样处理?什么时候不应该?
-
1、在get请求时,关键看你的tomcat的server.xml中的 “ <Connector port="8080" protocol="HTTP/1.1" connectionTimeout="20000" redirectPort="8443"/> ”这条connector中是否配置URIEncoding的值,不配置默认为iso8859-1,如果写上了如utf-8,你的程序就不需要转了,如果还转反而乱码。 2、在post请求时,就不用考虑该点了,只要写个字符过滤器全布设置成utf-8,就可以避免乱码了。 这些需要自己反复测试,才能有较深刻的理解。
http请求是以ISO-8859-1的编码来传送url的 如果页面的content-type为utf-8,那么在发送请求时,会将字符转成utf-8后进行传送 如: 中 的UTF-8编码为:E4 B8 AD在请求时为%E4%B8%AD字节之间是%分隔 那么服务器收到这段字节流后,必须将它转成相应的字符,平时所使用的request.getParameter("name")直接得到了字符串, 那么从字节流到字符流这个过程系统己经帮助我们完成了(乱码的产生由此开始)类似下面的程序:将汉字"中"的UTF-8形式转成汉字 public class EncodingTest { public static void main(String[] args) { String utf_string = "E4%B8%AD";//中的UTF-8编码,三个字节表示,用%分开 String[] utf_array = utf_string.split("%"); byte[] utf_byte = new byte[utf_array.length]; for(int i=0;i<utf_array.length;i++){ utf_byte[i] = (byte)Integer.parseInt(utf_array[i], 16); } try { System.out.println(new String(utf_byte,"UTF-8")); } catch (UnsupportedEncodingException e) { // TODO Auto-generated catch block e.printStackTrace(); } } } 请注意段代码:new String(utf_byte,"UTF-8")它将字节流以UTF-8的编码还原为字符串 但它使用的前提条件是utf_byte必须是utf-8的字节流, 如果这样: String aa = "中"; bb = aa.getBytes("ISO-8859-1"); new String(bb ,"UTF-8")肯定是乱码了 也就是说一个字符串以什么样的编码转换成字节流,就必须以什么样的编码进行还原 bb=aa.getBytes("UTF-8")就必须new String(bb,"UTF-8")否则乱码言归正传: url通过iso-8859-1传输,服务器收到这个字节流,默认会以ISO-8859-1来将这个字节流还原成相应的字符串, 就如同这样: 客户端:bb = aa.getBytes("UTF-8"); 到了服务器:cc = new String(bb,"ISO-8859-1")还原字节流为节符串 request.getParameter("");获取到这个cc,那么cc当然乱码了 所以就产生了这样的做法:new String(request.getParameter("").getBytes("ISO-8859-1"),"UTF-8")还原成原始字符串 将乱码字符串还原成原始的字节流,重新按UTF-8来编码.这里是因为
request.getParameter("")其实是进行了一次ISO-8859-1解码的,然后得到了一个乱码的字符串,那么就要重新按ISO-8859-1编码成字节流,然后在用
String(bb,"UTF-8")按UTF-8解码为字符流。
这里只是本人的一点看法,有误请大家指正
以上是关于tomcat的乱码问题的主要内容,如果未能解决你的问题,请参考以下文章