网站首页
JSP空间
动态资讯
开源项目
技术文档
资源下载
J2EE资源
客户论坛
在线支付
 
  技术文档>>JAVA>>新手入门>>基础入门>查看文档  
  java中文问题     
  文章作者:未知  文章来源:水木森林  
  查看:72次  录入:管理员--2007-11-17  
 
  写在前面的话:



java中文问题一直是困饶着初学java的主要问题,而且即使接触java有一段时间的“老手”也经常会在java的中文问题上栽跟头。下面就我个人理解,对java中文问题进行一些阐释。

理解java内部关于编码的原理:



java内部是unicode编码,所谓unicode编码即是:全世界所有符号进行了统一编码的结果。但是有一点值得提出一下,用它来处理汉字是合适的,但是英文却吃亏了,要用多一倍的空间来存储。所以程序员们写的程序不支持unicode情况很常见。

其他相关编码方式还有(说一些和中文相关的大家也许经常见到的编码方式):gb2312和gbk。其中gb2312是对gbk的升级,gbk是gb2312的一个子集,例如gb2312可以支持繁体字。big5是台湾编码方式。iso8859-1编码:iso8859_1,这个是英文系统缺省的8bit编码,因为是8bit的,所以不会把汉字的高位删去,所以用它也是可以处理汉字的。





理解java的io机制:



java的io基类分为:inputstream、outputstream和reader、writer

在i/o时如果使用reader/writer就要发生编码转换,使用系统属性file.encoding作为编码方式。如果使用stream就没有转换的事情了,那是binary的数据。

1、在reader/writer上加encoding的选项时候,在reader中的encoding表示把数据从encoding转换成unicode,writer就是把unicode的字符转换成encoding格式的。





2、用string.getbyte()把字符串转换成指定编码。





jsp/servlet问题:



jsp/servlet的中文问题有两种解决办法:

1、 不在程序中进行编码转换,把这个工作交给浏览器,方法就是用javac ?cencoding gbk *.java来编译所有的bean,然后在jsp页面上加
<%@ page contenttype="text/html;charset=gb2312" %>或者是在html中直接加: <meta http-equiv="content-type" content="text/html; charset=gb2312">
到底加那个,试试就知道了。

2、 在程序中指定编码,用javac ?cencoding iso8859_1 *.java来编译所有的bean,在涉及到中文显示的程序上加
str=new string(str.getbytes("iso8859_1"));

上面两种方法不能混用,意思就是要么就是gbk,要么就是iso8859_1,从里到外都一样就好了。

另外一个好办法就是采用filter:

import javax.servlet.*;

import java.io.*;





public class requestencodefilter implements filter {





string charset = null;





public void init(filterconfig config) throws servletexception {

charset = config.getinitparameter("charset");

if (charset == null)

charset = "gbk";

}





public void dofilter(servletrequest request, servletresponse response,

filterchain chain) throws ioexception,

servletexception {

request.setcharacterencoding(charset);

chain.dofilter(request, response);

}





public void destroy() {





}

}





在你的web.xml配置好fillter就可以了。这个方法是最便捷的,基本可以实现让java程序员原理中文问题。





数据库jdbc的中文问题:

一般只要按照数据库指定的编码进行转换,比如按照iso8859_1读,iso8859_1写,一般就没什么问题了。我也碰到过一些例外情况,如:对于存储的代码不进行转码机制,在数据库中存储的是乱码。但是,读取的时候却是正常的中文。我想这正好是unicodeà特定coding?>unicode编码,所以凑巧碰上了吧,我想数据库内部处理过程在起作用吧,当然我们谁也不喜欢一打开数据库看到的是一堆乱码。那就还是按照自己指定的方式来进行转码解码吧。





另外一种办法是:在jdbc连接数据库过程就进行字符编码转换:

如:connectionstring="jdbc:mysql://localhost/dbname?user=root&password=dphw&useunicode=true&characterencoding=8859_1(mysql的例子)





java和javaw:



他们的区别就不多说了,主要是java会在黑窗口下进行,而javaw不会,所以例如jb这样的开发工具都是默认采用javaw来进行run这些java的class的。

但是有一点需要提出的是:

javaw会使用与java不同的local配置进行工作,导致了一些中文问题,而java就是好好的。jbuilder也是好好的,没有问题,调用javaw也不是它的错,难道你想每次运行或者调试的时候蹦出个dos黑框么?

可以采用如下办法解决jb中的javaw造成的中文问题。

在jbuilder中选择project->project properties->run->edit->vm parameters,填上-dfile.encoding=gbk -ddefault.client.encoding=gbk -duser.language=zh -duser.region=cn 就行了!

原理也就是在javaw加上如上的配置参数。





其他配置方面:



在jdk低版本和unix下,需要改动font.properties,让java vm能够找到合适的字体来显示汉字。





总结:



上面就我所接触的几个方面谈谈java的中文问题。其中包括理解java内部关于编码的原理、理解java的io机制、jsp/servlet问题、 数据库jdbc的中文问题、java和javaw、其他配置方面。

肯定会有许多疏漏的地方,希望各位给予补充。
 
 
上一篇: java中文乱码的解决    下一篇: java中文问题及最优解法
  相关文档
j2me移动 2d 图形开发快速入门 11-17
castor jdo: 一个欺诈的广告 11-17
java程序把word文档直接转换成html文件 11-16
为什么text字段不能存取大于4k的数据 11-17
使用quick在java对象和xml之间进行转换 11-17
成功规划soa:什么是面向服务的架构 11-17
十年之后 java技术的新方向 11-16
高级技术分析:绿色和本地线程简单介绍 11-17
jakarta commons实现beancomparator 11-17
使用dom和xsl来格式化由java提取的数据 11-17
如何将java应用程序本地编译为exe 11-17
我的java培训与学习之路 11-17
java规则中级篇 11-17
java图像处理 11-17
struts学习笔记 11-17
java 理论与实践: 良好的内务处理实践 11-16
java基础-浅谈java中this的使用 11-17
java 理论与实践: 非阻塞算法简介 11-17
开发工具:用jbuiler玩转petstore 11-17
javascript实现划词标记+划词搜索功能 11-17
返回首页 | 关于我们 | J网章程 | JSP空间合租 | 客服中心 | 免责声明 | 常见问题 | 参观机房
本站主机空间代理至厦门市华众网络科技有限公司
《中华人民共和国增值电信业务经营许可证》
编号:闽B2-20050079
@2005-2008福建JSP技术网 版权所有 闽ICP备05000928号
技术电话:13616026886
邮箱:admin@fjjsp.com 站长QQ,点击这里给我发消息