新的起點(diǎn) 新的開始

          快樂生活 !

          j2ee中文解決終極之道(轉(zhuǎn))

          j2ee中文解決終極之道(轉(zhuǎn))

          Java中文問題一直困擾著很多初學(xué)者,如果了解了Java系統(tǒng)的中文問題原理,我們就可以對(duì)中文問題能夠采取根本的解決之道。  最古老的解決方案是使用String的字節(jié)碼轉(zhuǎn)換,這種方案問題是不方便,我們需要破壞對(duì)象封裝性,進(jìn)行字節(jié)碼轉(zhuǎn)換。

            還有一種方式是對(duì)J2EE容器進(jìn)行編碼設(shè)置,如果J2EE應(yīng)用系統(tǒng)脫離該容器,則會(huì)發(fā)生亂碼,而且指定容器配置不符合J2EE應(yīng)用和容器分離的原則。

          在Java內(nèi)部運(yùn)算中,涉及到的所有字符串都會(huì)被轉(zhuǎn)化為UTF-8編碼來進(jìn)行運(yùn)算。那么,在被Java轉(zhuǎn)化之前,字符串是什么樣的字符集? Java總是根據(jù)操作系統(tǒng)的默認(rèn)編碼字符集來決定字符串的初始編碼,而且Java系統(tǒng)的輸入和輸出的都是采取操作系統(tǒng)的默認(rèn)編碼。

          因此,如果能統(tǒng)一Java系統(tǒng)的輸入、輸出和操作系統(tǒng)3者的編碼字符集合,將能夠使Java系統(tǒng)正確處理和顯示漢字。這是處理Java系統(tǒng)漢字的一個(gè)原 則,但是在實(shí)際項(xiàng)目中,能夠正確抓住和控制住Java系統(tǒng)的輸入和輸出部分是比較難的。J2EE中,由于涉及到外部瀏覽器和數(shù)據(jù)庫等,所以中文問題亂碼顯 得非常突出。

            J2EE應(yīng)用程序是運(yùn)行在J2EE容器中。在這個(gè)系統(tǒng)中,輸入途徑有很多種:一種是通過頁面表單打包成請(qǐng)求 (request)發(fā)往服務(wù)器的;第二種是通過數(shù)據(jù)庫讀入;還有第3種輸入比較復(fù)雜,JSP在第一次運(yùn)行時(shí)總是被編譯成Servlet,JSP中常常包含 中文字符,那么編譯使用javac時(shí),Java將根據(jù)默認(rèn)的操作系統(tǒng)編碼作為初始編碼。除非特別指定,如在Jbuilder/eclipse中可以指定默 認(rèn)的字符集。

            輸出途徑也有幾種:第一種是JSP頁面的輸出。由于JSP頁面已經(jīng)被編譯成Servlet,那么在輸出時(shí),也將根據(jù)操作系統(tǒng)的默認(rèn)編碼來選擇輸出編碼,除非指定輸出編碼方式;還有輸出途徑是數(shù)據(jù)庫,將字符串輸出到數(shù)據(jù)庫。

            由此看來,一個(gè)J2EE系統(tǒng)的輸入輸出是非常復(fù)雜,而且是動(dòng)態(tài)變化的,而Java是跨平臺(tái)運(yùn)行的,在實(shí)際編譯和運(yùn)行中,都可能涉及到不同的操作系統(tǒng),如果任由Java自由根據(jù)操作系統(tǒng)來決定輸入輸出的編碼字符集,這將不可控制地出現(xiàn)亂碼。

            正是由于Java的跨平臺(tái)特性,使得字符集問題必須由具體系統(tǒng)來統(tǒng)一解決,所以在一個(gè)Java應(yīng)用系統(tǒng)中,解決中文亂碼的根本辦法是明確指定整個(gè)應(yīng)用系統(tǒng)統(tǒng)一字符集。

            指定統(tǒng)一字符集時(shí),到底是指定ISO8859_1 、GBK還是UTF-8呢?

            (1)如統(tǒng)一指定為ISO8859_1,因?yàn)槟壳按蠖鄶?shù)軟件都是西方人編制的,他們默認(rèn)的字符集就是ISO8859_1,包括操作系統(tǒng)Linux和數(shù)據(jù)庫MySQL等。這樣,如果指定Jive統(tǒng)一編碼為ISO8859_1,那么就有下面3個(gè)環(huán)節(jié)必須把握:

            開發(fā)和編譯代碼時(shí)指定字符集為ISO8859_1。

            運(yùn)行操作系統(tǒng)的默認(rèn)編碼必須是ISO8859_1,如Linux。

            在JSP頭部聲明:。

            (2)如果統(tǒng)一指定為GBK中文字符集,上述3個(gè)環(huán)節(jié)同樣需要做到,不同的是只能運(yùn)行在默認(rèn)編碼為GBK的操作系統(tǒng),如中文Windows。

            統(tǒng)一編碼為ISO8859_1和GBK雖然帶來編制代碼的方便,但是各自只能在相應(yīng)的操作系統(tǒng)上運(yùn)行。但是也破壞了Java跨平臺(tái)運(yùn)行的優(yōu)越性,只在一定范圍內(nèi)行得通。例如,為了使得GBK編碼在linux上運(yùn)行,設(shè)置Linux編碼為GBK。

            那么有沒有一種除了應(yīng)用系統(tǒng)以外不需要進(jìn)行任何附加設(shè)置的中文編碼根本解決方案呢?

            將Java/J2EE系統(tǒng)的統(tǒng)一編碼定義為UTF-8。UTF-8編碼是一種兼容所有語言的編碼方式,惟一比較麻煩的就是要找到應(yīng)用系統(tǒng)的所有出入口,然后使用UTF-8去“結(jié)扎”它。

            一個(gè)J2EE應(yīng)用系統(tǒng)需要做下列幾步工作:

          1. 開發(fā)和編譯代碼時(shí)指定字符集為UTF-8。JBuilder和Eclipse都可以在項(xiàng)目屬性中設(shè)置。
          2. 使用過濾器,如果所有請(qǐng)求都經(jīng)過一個(gè)Servlet控制分配器,那么使用Servlet的filter執(zhí)行語句,將所有來自瀏覽器的請(qǐng)求(request)轉(zhuǎn)換為UTF-8,因?yàn)闉g覽器發(fā)過來的請(qǐng)求包根據(jù)瀏覽器所在的操作系統(tǒng)編碼,可能是各種形式編碼。關(guān)鍵一句:
            request.setCharacterEncoding(”UTF-8″)。
            網(wǎng)上有此filter的源碼,Jdon框架源碼中com.jdon.util.SetCharacterEncodingFilter
            需要配置web.xml 激活該Filter。
          3. 在JSP頭部聲明:。
          4. 在Jsp的html代碼中,聲明UTF-8:
          5. 設(shè)定數(shù)據(jù)庫連接方式是UTF-8。例如連接MYSQL時(shí)配置URL如下:
            jdbc:mysql://localhost:3306/test?useUnicode=true&characterEncoding=UTF-8
            注意,上述寫法是JBoss的mysql-ds.xml寫法,多虧網(wǎng)友提示,在tomcat中&要寫成&即可。一般其他數(shù)據(jù)庫都可以通過管理設(shè)置設(shè)定UTF-8
          6. 其他和外界交互時(shí)能夠設(shè)定編碼時(shí)就設(shè)定UTF-8,例如讀取文件,操作XML等。

          筆者以前在Jsp/Servlet時(shí)就采取這個(gè)原則,后來使用Struts、Tapestry、EJB、Hibernate、Jdon等框架時(shí),從未被亂 碼困擾過,可以說適合各種架構(gòu)。希望本方案供更多初學(xué)者分享,減少Java/J2EE的第一個(gè)攔路虎,也避免因?yàn)椴扇∫恍┡R時(shí)解決方案,導(dǎo)致中文問題一直 出現(xiàn)在新的技術(shù)架構(gòu)中。


          另一篇文章


          對(duì)于一個(gè)Java初學(xué)者來說,經(jīng)常碰到的一個(gè)問題恐怕就是中文問題 了。其實(shí)很正常,我們有幾千年的悠久歷史嘛,博大精深,豈能是小小的計(jì)算機(jī)語言所能包容的?呵呵,開個(gè)玩笑。但是不可否認(rèn)的一個(gè)事實(shí)就是,就算是一個(gè)比較 有經(jīng)驗(yàn)的開發(fā)人員,也經(jīng)常面對(duì)著屏幕上的亂碼而大傷腦筋。

          想究其原因、徹底解決這一問題嗎?follow me……

          亂碼原因
          java內(nèi)核是unicode的。但Java總是根據(jù)操作系統(tǒng)的默認(rèn)編碼字符集來決定字符串的初始編碼,而且Java系統(tǒng)的輸入和輸出的都是采取操作系 統(tǒng)的默認(rèn)編碼,而數(shù)據(jù)庫、文件、網(wǎng)絡(luò)傳輸中的字節(jié)流……采用的編碼更是各不相同。所以不可避免的就會(huì)出現(xiàn)煩人的亂碼問題了。

          解決辦法
          1、GB2312、GBK、Unicode(UTF8)?
          從字符集的大小比較 GB2312 < GBK < UTF8,很顯然,如果我們采用UTF8作為系統(tǒng)編碼的話,是不會(huì)有錯(cuò)的。而且如果你要考慮國際化的話,UTF8似乎是你唯一的選擇
          2、開發(fā)和編譯代碼時(shí)指定字符集為UTF-8
          JBuilder和Eclipse都可以在項(xiàng)目屬性中設(shè)置。
          3、使用過濾器
          編寫過濾器

          package com.javer.test.language;

          import javax.servlet.Filter;
          import javax.servlet.FilterChain;
          import javax.servlet.FilterConfig;
          import javax.servlet.ServletRequest;
          import javax.servlet.ServletResponse;

          /**
          * <p>Title: EncodingFilter</p>
          * @author javer(QQ:84831612)
          * @version 1.0
          * @link http://blog.csdn.net/java008
          */
          public class EncodingFilter
          implements Filter
          {
          FilterConfig config;

          public void init(FilterConfig parm1)
          throws javax.servlet.ServletException
          {
          this.config = parm1;
          }

          public void doFilter(ServletRequest req, ServletResponse res, FilterChain chain)
          throws java.io.IOException, javax.servlet.ServletException
          {
          if (req.getCharacterEncoding() == null || !req.getCharacterEncoding().equals("UTF-8"))
          {
          req.setCharacterEncoding("UTF-8");
          }
          chain.doFilter(req, res);
          }

          public void destroy()
          {
          this.config = null;
          }
          }
          在web.xml文件中配置該過濾器
          <?xml version="1.0" encoding="UTF-8"?>
          <!DOCTYPE web-app PUBLIC "-//Sun Microsystems, Inc.//DTD Web Application 2.3//EN" "http://java.sun.com/dtd/web-app_2_3.dtd">
          <web-app>
          <display-name>javer‘s project</display-name>
          <filter>
          <filter-name>EncodingFilter</filter-name>
          <display-name>EncodingFilter</display-name>
          <description>對(duì)編碼進(jìn)行轉(zhuǎn)換</description>
          <filter-class>com.javer.test.language.EncodingFilter</filter-class>
          </filter>
          <filter-mapping>
          <filter-name>EncodingFilter</filter-name>
          <url-pattern>/*</url-pattern>
          </filter-mapping>
          <welcome-file-list>
          <welcome-file>index.jsp</welcome-file>
          </welcome-file-list>
          </web-app>
          4、在JSP 中進(jìn)行聲明
          在JSP頭部聲明<%@ page contentType="text/html;charset= UTF-8" %>
          在Jsp的html代碼中聲明<meta http-equiv="Content-Type" content="text/html; charset=utf-8">
          5、數(shù)據(jù)庫管理
          一般數(shù)據(jù)庫都可以通過管理設(shè)置設(shè)定UTF-8
          也可以通過jdbc鏈接時(shí)指定編碼參數(shù),如:mysql:jdbc:mysql://localhost:3306/test?useUnicode=true&characterEncoding=utf-8
          6、其它
          其他所有和外界交互時(shí)能夠設(shè)定編碼時(shí)就設(shè)定UTF-8,例如讀取文件,操作XML等。總之,記住一個(gè)原則:在所有系統(tǒng)的出入口處都用UTF8編碼進(jìn)行“翻譯”!

          posted on 2007-09-26 13:28 advincenting 閱讀(181) 評(píng)論(0)  編輯  收藏


          只有注冊(cè)用戶登錄后才能發(fā)表評(píng)論。


          網(wǎng)站導(dǎo)航:
           

          公告

          Locations of visitors to this pageBlogJava
        1. 首頁
        2. 新隨筆
        3. 聯(lián)系
        4. 聚合
        5. 管理
        6. <2007年9月>
          2627282930311
          2345678
          9101112131415
          16171819202122
          23242526272829
          30123456

          統(tǒng)計(jì)

          常用鏈接

          留言簿(13)

          隨筆分類(71)

          隨筆檔案(179)

          文章檔案(13)

          新聞分類

          IT人的英語學(xué)習(xí)網(wǎng)站

          JAVA站點(diǎn)

          優(yōu)秀個(gè)人博客鏈接

          官網(wǎng)學(xué)習(xí)站點(diǎn)

          生活工作站點(diǎn)

          最新隨筆

          搜索

          積分與排名

          最新評(píng)論

          閱讀排行榜

          評(píng)論排行榜

          主站蜘蛛池模板: 彭泽县| 辽宁省| 隆昌县| 浠水县| 柘荣县| 旬邑县| 甘洛县| 南郑县| 新龙县| 深水埗区| 偏关县| 阿巴嘎旗| 图木舒克市| 咸阳市| 旌德县| 娱乐| 赫章县| 手游| 柳州市| 屯留县| 福泉市| 淳化县| 丰宁| 闻喜县| 农安县| 都昌县| 台江县| 民乐县| 车险| 卢龙县| 龙井市| 上虞市| 隆安县| 宁乡县| 京山县| 建始县| 定南县| 沙田区| 金乡县| 云霄县| 大城县|