JSP中pageEncoding和charset区别，中文乱码解决方案

来源：未知责任编辑：责任编辑发表时间:2014-03-23 22:27　点击:次

ASP PHP JSP JavaScript 网页设计 DIVCSS Ajax技术 HTML5

JSP指令标签中<%@ page contentType="text/html;charset=GB2312"%>这句有什么用途？
关于JSP页面中的pageEncoding和contentType两种属性的区别：
　　pageEncoding是jsp文件本身的编码
　　contentType的charset是指服务器发送给客户端时的内容编码
　　JSP要经过两次的“编码”，第一阶段会用pageEncoding，第二阶段会用utf-8至utf-8，第三阶段就是由Tomcat出来的网页，用的是contentType。
　　第一阶段是jsp编译成.java，它会根据pageEncoding的设定读取jsp，结果是由指定的编码方案翻译成统一的UTF-8 JAVA源码（即.java），如果pageEncoding设定错了，或没有设定，出来的就是中文乱码。
　　第二阶段是由JAVAC的JAVA源码至java byteCode的编译，不论JSP编写时候用的是什么编码方案，经过这个阶段的结果全部是UTF-8的encoding的java源码。
　　JAVAC用UTF-8的encoding读取java源码，编译成UTF-8 encoding的二进制码（即.class），这是JVM对常数字串在二进制码（java encoding）内表达的规范。
　　第三阶段是Tomcat（或其的application container）载入和执行阶段二的来的JAVA二进制码，输出的结果，也就是在客户端见到的，这时隐藏在阶段一和阶段二的参数contentType就发挥了功效
　　contentType的設定.
　　pageEncoding 和contentType的预设都是 ISO8859-1. 而随便设定了其中一个, 另一个就跟着一样了(TOMCAT4.1.27是如此). 但这不是绝对的, 这要看各自JSPC的处理方式. 而pageEncoding不等于contentType, 更有利亚洲区的文字 CJKV系JSP网页的开发和展示, (例pageEncoding=GB2312 不等于 contentType=utf-8)。
　　jsp文件不像.java，.java在被编译器读入的时候默认采用的是操作系统所设定的locale所对应的编码，比如中国大陆就是GBK，台湾就是BIG5或者MS950。而一般我们不管是在记事本还是在ue中写代码，如果没有经过特别转码的话，写出来的都是本地编码格式的内容。所以编译器采用的方法刚好可以让虚拟机得到正确的资料。
　　但是jsp文件不是这样，它没有这个默认转码过程，但是指定了pageEncoding就可以实现正确转码了。
　　举个例子:
<%@ page contentType="text/html;charset=utf-8" %>
　　大都会打印出乱码，因为输入的“你好”是gbk的，但是服务器是否正确抓到“你好”不得而知。
　　但是如果更改为
<%@ page contentType="text/html;charset=utf-8" pageEncoding="GBK"%>
　　这样就服务器一定会是正确抓到“你好”了。

Java中将数据由UTF8转换成GB2312格式
关键字: java字符编码
UTF8转换成GB2312 当我们在基于HTTP协议的JSP或Servlet的应用中获取数据或发送请求时，JVM会把输送的数据编码成UTF8格式。如果我们直接从HTTP流中提取中文数据，提取的结果为“????”（可能更多问号），为转换成我们能够理解的中文字符，我们需要把UTF8转换成GB2312，借助ISO- 8859-1标准编码能够轻易的实现，下面的代码实现了这一功能：

byte [] b;
String utf8_value;
utf8_value = request.getParameter("NAME");//从HTTP流中取"NAME"的UTF8数据
b = utf8_value.getBytes("8859_1"); //中间用ISO-8859-1过渡
String name = new String(b, "GB2312"); //转换成GB2312字符

这是我做的一个项目程序的一段：
      byte[] b;
    String gbk_value;
    gbk_value=request.getParameter("address");//从HTTP流中取"name"的GBK数据（由于web.xml中过滤器设置默认编码为GBK，所以外网从UTF-8变为GBK）

JSP中pageEncoding和charset区别，中文乱码解决方案

相关新闻>>

今日头条

推荐热点

您可能感兴趣的文章

快速直达

新闻点评智问网络

新闻关注排行榜

WEB编程导航