欢迎来到冰点文库! | 帮助中心 分享价值,成长自我!
冰点文库
全部分类
  • 临时分类>
  • IT计算机>
  • 经管营销>
  • 医药卫生>
  • 自然科学>
  • 农林牧渔>
  • 人文社科>
  • 工程科技>
  • PPT模板>
  • 求职职场>
  • 解决方案>
  • 总结汇报>
  • ImageVerifierCode 换一换
    首页 冰点文库 > 资源分类 > DOCX文档下载
    分享到微信 分享到微博 分享到QQ空间

    深入剖析Java编程中的中文问题及建议最优解决方法Word文件下载.docx

    • 资源ID:6227286       资源大小:87.93KB        全文页数:13页
    • 资源格式: DOCX        下载积分:3金币
    快捷下载 游客一键下载
    账号登录下载
    微信登录下载
    三方登录下载: 微信开放平台登录 QQ登录
    二维码
    微信扫一扫登录
    下载资源需要3金币
    邮箱/手机:
    温馨提示:
    快捷下载时,用户名和密码都是您填写的邮箱或者手机号,方便查询和重复下载(系统自动生成)。
    如填写123,账号就是123,密码也是123。
    支付方式: 支付宝    微信支付   
    验证码:   换一换

    加入VIP,免费下载
     
    账号:
    密码:
    验证码:   换一换
      忘记密码?
        
    友情提示
    2、PDF文件下载后,可能会被浏览器默认打开,此种情况可以点击浏览器菜单,保存网页到桌面,就可以正常下载了。
    3、本站不支持迅雷下载,请使用电脑自带的IE浏览器,或者360浏览器、谷歌浏览器下载即可。
    4、本站资源下载后的文档和图纸-无水印,预览文档经过压缩,下载后原文更清晰。
    5、试题试卷类文档,如果标题没有明确说明有答案则都视为没有答案,请知晓。

    深入剖析Java编程中的中文问题及建议最优解决方法Word文件下载.docx

    1、这些类文件中,都有可能含有中文字符串,并且我们常用前三类JAVA程序和用户直接交互,用于输出和输入字符,如:我们在JSP和Servlet中得到客户端送来的字符,这些字符也包括中文字符。无论这些JAVA类的作用如何,这些JAVA程序的生命周期都是这样的:*编程人员在一定的操作系统上选择一个合适的编辑软件来实现源程序代码并以.java扩展名保存在操作系统中,例如我们在中文win2k中用记事本编辑一个java源程序; *编程人员用JDK中的javac.exe来编译这些源代码,形成.class类(JSP文件是由容器调用JDK来编译的); *直接运行这些类或将这些类布署到WEB容器中去运行,并输出结果。

    2、那么,在这些过程中,JDK和JVM是如何将这些文件如何编码和解码并运行的呢?这里,我们以中文win2k操作系统为例说明JAVA类是如何来编码和被解码的。第一步,我们在中文win2k中用编辑软件如记事本编写一个Java源程序文件(包括以上五类JAVA程序),程序文件在保存时默认采用了操作系统默认支持GBK编码格式(操作系统默认支持的格式为file.encoding格式)形成了一个.java文件,也即,java程序在被编译前,我们的JAVA源程序文件是采用操作系统默认支持的file.encoding编码格式保存的,java源程序中含有中文信息字符和英文程序代码;要查看系统的file.encodin

    3、g参数,可以用以下代码:public class ShowSystemDefaultEncoding public static void main(String args) String encoding = System.getProperty(file.encoding);System.out.println(encoding);第二步,我们用JDK的javac.exe文件编译我们的Java源程序,由于JDK是国际版的,在编译的时候,如果我们没有用-encoding参数指定我们的JAVA源程序的编码格式,则javac.exe首先获得我们操作系统默认采用的编码格式,也即在编译java程序时

    4、,若我们不指定源程序文件的编码格式,JDK首先获得操作系统的file.encoding参数(它保存的就是操作系统默认的编码格式,如WIN2k,它的值为GBK),然后JDK就把我们的java源程序从file.encoding编码格式转化为JAVA内部默认的UNICODE格式放入内存中。然后,javac把转换后的unicode格式的文件进行编译成.class类文件,此时.class文件是UNICODE编码的,它暂放在内存中,紧接着,JDK将此以UNICODE编码的编译后的class文件保存到我们的操作系统中形成我们见到的.class文件。对我们来说,我们最终获得的.class文件是内容以UNICO

    5、DE编码格式保存的类文件,它内部包含我们源程序中的中文字符串,只不过此时它己经由file.encoding格式转化为UNICODE格式了。这一步中,对于JSP源程序文件是不同的,对于JSP,这个过程是这样的:即WEB容器调用JSP编译器,JSP编译器先查看JSP文件中是否设置有文件编码格式,如果JSP文件中没有设置JSP文件的编码格式,则JSP编译器调用JDK先把JSP文件用JVM默认的字符编码格式(也即WEB容器所在的操作系统的默认的file.encoding)转化为临时的Servlet类,然后再把它编译成UNICODE格式的class类,并保存在临时文件夹中。在中文win2k上,WEB容器

    6、就把JSP文件从GBK编码格式转化为UNICODE格式,然后编译成临时保存的Servlet类,以响应用户的请求。第三步,运行第二步编译出来的类,分为三种情况:A、 直接在console上运行的类B、 EJB类和不可以直接运行的支持类(如JavaBean类)C、 JSP代码和Servlet类D、 JAVA程序和数据库之间下面我们分这四种情况来看。A、直接在console上运行的类这种情况,运行该类首先需要JVM支持,即操作系统中必须安装有JRE。运行过程是这样的:首先java启动JVM,此时JVM读出操作系统中保存的class文件并把内容读入内存中,此时内存中为UNICODE格式的class类,

    7、然后JVM运行它,如果此时此类需要接收用户输入,则类会默认用file.encoding编码格式对用户输入的串进行编码并转化为unicode保存入内存(用户可以设置输入流的编码格式)。程序运行后,产生的字符串(UNICODE编码的)再回交给JVM,最后JRE把此字符串再转化为file.encoding格式(用户可以设置输出流的编码格式)传递给操作系统显示接口并输出到界面上。对于这种直接在console上运行的类,它的转化过程可用图1更加明确的表示出来:以上每一步的转化都需要正确的编码格式转化,才能最终不出现乱码现象。B、EJB类和不可以直接运行的支持类(如JavaBean类)由于EJB类和不可以

    8、直接运行的支持类,它们一般不与用户直接交互输入和输出,它们常常与其它的类进行交互输入和输出,所以它们在第二步被编译后,就形成了内容是UNICODE编码的类保存在操作系统中了,以后只要它与其它的类之间的交互在参数传递过程中没有丢失,则它就会正确的运行。这种EJB类和不可以直接运行的支持类, 它的转化过程可用图2更加明确的表示出来:C、JSP代码和Servlet类经过第二步后,JSP文件也被转化为Servlets类文件,只不过它不像标准的Servlets一校存在于classes目录中,它存在于WEB容器的临时目录中,故这一步中我们也把它做为Servlets来看。对于Servlets,客户端请求它时

    9、,WEB容器调用它的JVM来运行Servlet,首先,JVM把Servlet的class类从系统中读出并装入内存中,内存中是以UNICODE编码的Servlet类的代码,然后JVM在内存中运行该Servlet类,如果Servlet在运行的过程中,需要接受从客户端传来的字符如:表单输入的值和URL中传入的值,此时如果程序中没有设定接受参数时采用的编码格式,则WEB容器会默认采用ISO-8859-1编码格式来接受传入的值并在JVM中转化为UNICODE格式的保存在WEB容器的内存中。Servlet运行后生成输出,输出的字符串是UNICODE格式的,紧接着,容器将Servlet运行产生的UNICOD

    10、E格式的串(如html语法,用户输出的串等)直接发送到客户端浏览器上并输出给用户,如果此时指定了发送时输出的编码格式,则按指定的编码格式输出到浏览器上,如果没有指定,则默认按ISO-8859-1编码发送到客户的浏览器上。这种JSP代码和Servlet类,它的转化过程可用图3更加明确地表示出来:D、Java程序和数据库之间对于几乎所有数据库的JDBC驱动程序,默认的在JAVA程序和数据库之间传递数据都是以ISO-8859-1为默认编码格式的,所以,我们的程序在向数据库内存储包含中文的数据时,JDBC首先是把程序内部的UNICODE编码格式的数据转化为ISO-8859-1的格式,然后传递到数据库中

    11、,在数据库保存数据时,它默认即以ISO-8859-1保存,所以,这是为什么我们常常在数据库中读出的中文数据是乱码。对于JAVA程序和数据库之间的数据传递,我们可以用图4清晰地表示出来:3、分析常见的JAVA中文问题几个必须清楚的原则首先,经过上面的详细分析,我们可以清晰地看到,任何JAVA程序的生命期中,其编码转换的关键过程是在于:最初编译成class文件的转码和最终向用户输出的转码过程。其次,我们必须了解JAVA在编译时支持的、常用的编码格式有以下几种:*ISO-8859-1,8-bit, 同8859_1,ISO-8859-1,ISO_8859_1等编码*Cp1252,美国英语编码,同ANS

    12、I标准编码*UTF-8,同unicode编码*GB2312,同gb2312-80,gb2312-1980等编码*GBK , 同MS936,它是gb2312的扩充及其它的编码,如韩文、日文、繁体中文等。同时,我们要注意这些编码间的兼容关体系如下:unicode和UTF-8编码是一一对应的关系。GB2312可以认为是GBK的子集,即GBK编码是在gb2312上扩展来的。同时,GBK编码包含了20902个汉字,编码范围为:0x8140-0xfefe,所有的字符可以一一对应到UNICODE2.0中来。再次,对于放在操作系统中的.java源程序文件,在编译时,我们可以指定它内容的编码格式,具体来说用-e

    13、ncoding来指定。注意:如果源程序中含有中文字符,而你用-encoding指定为其它的编码字符,显然是要出错的。用-encoding指定源文件的编码方式为GBK或gb2312,无论我们在什么系统上编译含有中文字符的JAVA源程序都不会有问题,它都会正确地将中文转化为UNICODE存储在class文件中。然后,我们必须清楚,几乎所有的WEB容器在其内部默认的字符编码格式都是以ISO-8859-1为默认值的,同时,几乎所有的浏览器在传递参数时都是默认以UTF-8的方式来传递参数的。所以,虽然我们的Java源文件在出入口的地方指定了正确的编码方式,但其在容器内部运行时还是以ISO-8859-1来

    14、处理的。4、中文问题的分类及其建议最优解决办法了解以上JAVA处理文件的原理之后,我们就可以提出了一套建议最优的解决汉字问题的办法。我们的目标是:我们在中文系统中编辑的含有中文字符串或进行中文处理的JAVA源程序经编译后可以移值到任何其它的操作系统中正确运行,或拿到其它操作系统中编译后能正确运行,能正确地传递中文和英文参数,能正确地和数据库交流中英文字符串。我们的具体思路是:在JAVA程序转码的入口和出口及JAVA程序同用户有输入输出转换的地方限制编码方法使之正确即可。具体解决办法如下:1、 针对直接在console上运行的类对于这种情况,我们建议在程序编写时,如果需要从用户端接收用户的可能含

    15、有中文的输入或含有中文的输出,程序中应该采用字符流来处理输入和输出,具体来说,应用以下面向字符型节点流类型:对文件:FileReader,FileWrieter 其字节型节点流类型为:FileInputStream,FileOutputStream对内存(数组):CharArrayReader,CharArrayWriterByteArrayInputStream,ByteArrayOutputStream对内存(字符串):StringReader,StringWriter对管道:PipedReader,PipedWriterPipedInputStream,PipedOutputStream

    16、同时,应该用以下面向字符型处理流来处理输入和输出:BufferedWriter,BufferedReader其字节型的处理流为:BufferedInputeStream,BufferedOutputStreamInputStreamReader,OutputStreamWriterDataInputStream,DataOutputStream其中InputStreamReader和InputStreamWriter用于将字节流按照指定的字符编码集转换到字符流,如:InputStreamReader in = new InputStreamReader(System.in,GB2312);Ou

    17、tputStreamWriter out = new OutputStreamWriter (System.out,例如:采用如下的示例JAVA编码就达到了要求:/Read.javaimport java.io.*;public class Read public static void main(String args) throws IOException String str = n中文测试,这是内部硬编码的串+ntest english character;String strin= BufferedReader stdin = new BufferedReader(new Input

    18、StreamReader(System.in,gb2312); /设置输入接口按中文编码BufferedWriter stdout = new BufferedWriter(new OutputStreamWriter(System.out, /设置输出接口按中文编码stdout.write(请输入:stdout.flush();strin = stdin.readLine();这是从用户输入的串:+strin);stdout.write(str);同时,在编译程序时,我们用以下方式来进行:javac -encoding gb2312 Read.java其运行结果如图5所示:2、 针对EJB类

    19、和不可以直接运行的支持类(如JavaBean类)由于这种类它们本身被其它的类调用,不直接与用户交互,故对这种类来说,我们的建议的处理方式是内部程序中应该采用字符流来处理程序内部的中文字符串(具体如上面一节中一样),同时,在编译类时用-encoding gb2312参数指示源文件是中文格式编码的即可。3、 针对Servlet类针对Servlet,我们建议用以下方法:在编译Servlet类的源程序时,用-encoding指定编码为GBK或GB2312,且在向用户输出时的编码部分用response对象的setContentType(text/html;charset=GBK或gb2312来设置输出编

    20、码格式,同样在接收用户输入时,我们用request.setCharacterEncoding(这样无论我们的servlet类移植到什么操作系统中,只有客户端的浏览器支持中文显示,就可以正确显示。如下是一个正确的示例:/HelloWorld.javapackage hello;import javax.servlet.*;import javax.servlet.http.*;public class HelloWorld extends HttpServletpublic void init() throws ServletException public void doGet(HttpSer

    21、vletRequest request, HttpServletResponse response) throws IOException, ServletExceptionrequest.setCharacterEncoding( /设置输入编码格式response.setContentType(charset=GB2312 /设置输出编码格式PrintWriter out = response.getWriter(); /建议使用PrintWriter输出out.println(Hello World! This is created by Servlet!测试中文!public void

    22、 doPost(HttpServletRequest request, HttpServletResponse response) throws IOException, ServletExceptionString name = request.getParameter(nameString id = request.getParameter(idif(name=null) name=if(id=null) id=你传入的中文字串是: + name);你输入的id是: + id);public void destroy() 请用javac -encoding gb2312 HelloWorl

    23、d.java来编译此程序。测试此Servlet的程序如下所示:%page contentType= charset=gb2312%request.setCharacterEncoding(htmlheadtitle/titleScript language=JavaScriptfunction Submit() /通过URL传递中文字符串值给Servletdocument.base.action = ./HelloWorld?name=中文document.base.method = POSTdocument.base.submit();/Script/headbody bgcolor=#FF

    24、FFFF text=#000000 topmargin=5form name=base method = target=_selfinput name= type=text value= size=30a href = JavaScript:Submit()传给Servlet/form/body/html其运行结果如图6所示:4、 JAVA程序和数据库之间为避免JAVA程序和数据库之间数据传递出现乱码现象,我们建议采用以下最优方法来处理:1、 对于JAVA程序的处理方法按我们指定的方法处理。2、 把数据库默认支持的编码格式改为GBK或GB2312的。在mysql中,我们可以在配置文件my.ini中加入以下语句实现:在mysqld区增加:default-character-set=gbk并增加:client在SQL Server2K中,我们可以将数据库默认的语言设置为Simplified Chinese来达到目的。5、 针对JSP代码由于JSP是在运行时,由WEB容器进行动态编译的,如果我们没有指定JSP源文件的编码格式,则JSP编译器会获得服务器操作系统的file.encoding值来对JSP文件编译的,它在移植时最容易出问题


    注意事项

    本文(深入剖析Java编程中的中文问题及建议最优解决方法Word文件下载.docx)为本站会员主动上传,冰点文库仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知冰点文库(点击联系客服),我们立即给予删除!

    温馨提示:如果因为网速或其他原因下载失败请重新下载,重复下载不扣分。




    关于我们 - 网站声明 - 网站地图 - 资源地图 - 友情链接 - 网站客服 - 联系我们

    copyright@ 2008-2023 冰点文库 网站版权所有

    经营许可证编号:鄂ICP备19020893号-2


    收起
    展开