樂(lè)於JAVA
          幸福人生(J2EE)
          posts - 0,  comments - 5,  trackbacks - 0

          自從接觸Java和JSP以來(lái),就不斷與Java的中文亂碼問(wèn)題打交道,現(xiàn)在終于得到了徹底的解決,現(xiàn)將我們的解決心得與大家共享。

          一、Java中文問(wèn)題的由來(lái)

          Java的內(nèi)核和class文件是基于unicode的,這使Java程序具有良好的跨平臺(tái)性,但也帶來(lái)了一些中文亂碼問(wèn)題的麻煩。原因主要有兩方面,Java和JSP文件本身編譯時(shí)產(chǎn)生的亂碼問(wèn)題和Java程序于其他媒介交互產(chǎn)生的亂碼問(wèn)題。

          首 先Java(包括JSP)源文件中很可能包含有中文,而Java和JSP源文件的保存方式是基于字節(jié)流的,如果Java和JSP編譯成class文件過(guò)程 中,使用的編碼方式與源文件的編碼不一致,就會(huì)出現(xiàn)亂碼。基于這種亂碼,建議在Java文件中盡量不要寫(xiě)中文(注釋部分不參與編譯,寫(xiě)中文沒(méi)關(guān)系),如果 必須寫(xiě)的話(huà),盡量手動(dòng)帶參數(shù)-ecoding GBK或-ecoding gb2312編譯;對(duì)于JSP,在文件頭加上<%@ page contentType="text/html;charset=GBK"%>或<%@ page contentType="text/html;charset=gb2312"%>基本上就能解決這類(lèi)亂碼問(wèn)題。

          本文要重點(diǎn)討論的是第二類(lèi)亂碼,即Java程序與其他存儲(chǔ)媒介交互時(shí)產(chǎn)生的亂碼。很多存儲(chǔ)媒介,如數(shù)據(jù)庫(kù),文件,流等的存儲(chǔ)方式都是基于字節(jié)流的,Java程序與這些媒介交互時(shí)就會(huì)發(fā)生字符(char)與字節(jié)(byte)之間的轉(zhuǎn)換,具體情況如下:

          從頁(yè)面form提交數(shù)據(jù)到j(luò)ava程序 byte->char
          從java程序到頁(yè)面顯示 char—>byte

          從數(shù)據(jù)庫(kù)到j(luò)ava程序 byte—>char
          從java程序到數(shù)據(jù)庫(kù) char—>byte

          從文件到j(luò)ava程序 byte->char
          從java程序到文件 char->byte

          從流到j(luò)ava程序 byte->char
          從java程序到流 char->byte

          如果在以上轉(zhuǎn)換過(guò)程中使用的編碼方式與字節(jié)原有的編碼不一致,很可能就會(huì)出現(xiàn)亂碼。

          二、解決方法

          前面已經(jīng)提到了Java程序與其他媒介交互時(shí)字符和字節(jié)的轉(zhuǎn)換過(guò)程,如果這些轉(zhuǎn)換過(guò)程中容易產(chǎn)生亂碼。解決這些亂碼問(wèn)題的關(guān)鍵在于確保轉(zhuǎn)換時(shí)使用的編碼方式與字節(jié)原有的編碼方式保持一致,下面分別論述(Java或JSP自身產(chǎn)生的亂碼請(qǐng)參看第一部分)。

          1、JSP與頁(yè)面參數(shù)之間的亂碼
          JSP 獲取頁(yè)面參數(shù)時(shí)一般采用系統(tǒng)默認(rèn)的編碼方式,如果頁(yè)面參數(shù)的編碼類(lèi)型和系統(tǒng)默認(rèn)的編碼類(lèi)型不一致,很可能就會(huì)出現(xiàn)亂碼。解決這類(lèi)亂碼問(wèn)題的基本方法是在頁(yè) 面獲取參數(shù)之前,強(qiáng)制指定request獲取參數(shù)的編碼方式:request.setCharacterEncoding("GBK")或 request.setCharacterEncoding("gb2312")。
          如果在JSP將變量輸出到頁(yè)面時(shí)出現(xiàn)了亂碼,可以通過(guò)設(shè)置 response.setContentType("text/html;charset=GBK")或response.setContentType ("text/html;charset=gb2312")解決。
          如果不想在每個(gè)文件里都寫(xiě)這樣兩句話(huà),更簡(jiǎn)潔的辦法是使用Servlet規(guī)范中的過(guò)慮器指定編碼,過(guò)濾器的在web.xml中的典型配置和主要代碼如下:
          web.xml:

          <filter>
          <filter-name>encoding</filter-name>
          <filter-class>EncodingFilter</filter-class>
          <init-param>
          <param-name>encoding</param-name>
          <param-value>GBK</param-value>
          </init-param>
          </filter>
          <filter-mapping>
          <filter-name>encoding</filter-name>
          <url-pattern>/*</url-pattern>
          </filter-mapping>

          EncodingFilter.java:

          import java.io.IOException;
          import javax.servlet.FilterChain;
          import javax.servlet.ServletRequest;
          import javax.servlet.ServletResponse;
          import javax.servlet.Filter;
          import javax.servlet.http.HttpServletRequest;
          import javax.servlet.http.HttpServletResponse;
          import javax.servlet.ServletException;
          import javax.servlet.FilterConfig;

          public class EncodingFilter implements Filter{

          protected FilterConfig filterConfig;
          private String targetEncoding="GBK";
          /**
          * 初始化過(guò)濾器,獲得初始參數(shù)
          */
          public void init(FilterConfig config)throws ServletException{
          this.filterConfig = config;
          this.targetEncoding = config.getInitParameter("encoding");
          }
          /**
          * 進(jìn)行過(guò)濾處理,這個(gè)方法最重要,所有的過(guò)濾處理代碼都在此實(shí)現(xiàn)
          */
          public void doFilter(ServletRequest srequest,ServletResponse sresponse,FilterChain chain)throws IOException,ServletException{
          System.out.println("使用一下方法對(duì)請(qǐng)求進(jìn)行編碼:encoding="+targetEncoding);
          HttpServletRequest request=(HttpServletRequest)srequest;
          request.setCharacterEncoding(targetEncoding);
          //把處理權(quán)發(fā)送到下一個(gè)
          chain.doFilter(srequest,sresponse);
          }
          public void setFilterConfig(final FilterConfig filterConfig){
          this.filterConfig=filterConfig;
          }
          //銷(xiāo)毀過(guò)濾器
          public void destroy(){
          this.filterConfig=null;
          }
          }


          2、Java與數(shù)據(jù)庫(kù)之間的亂碼
          大 部分?jǐn)?shù)據(jù)庫(kù)都支持以u(píng)nicode編碼方式,所以解決Java與數(shù)據(jù)庫(kù)之間的亂碼問(wèn)題比較明智的方式是直接使用unicode編碼與數(shù)據(jù)庫(kù)交互。很多數(shù)據(jù) 庫(kù)驅(qū)動(dòng)自動(dòng)支持unicode,如Microsoft的SQLServer驅(qū)動(dòng)。其他大部分?jǐn)?shù)據(jù)庫(kù)驅(qū)動(dòng),可以在驅(qū)動(dòng)的url參數(shù)中指定,如如mm的 mysql驅(qū)動(dòng):jdbc:mysql://localhost/WEBCLDB?useUnicode=true& characterEncoding=GBK。

          3、Java與文件/流之間的亂碼
          Java讀寫(xiě)文件最常用的類(lèi)是 FileInputStream/FileOutputStream和FileReader/FileWriter。其中FileInputStream 和FileOutputStream是基于字節(jié)流的,常用于讀寫(xiě)二進(jìn)制文件。讀寫(xiě)字符文件建議使用基于字符的FileReader和 FileWriter,省去了字節(jié)與字符之間的轉(zhuǎn)換。但這兩個(gè)類(lèi)的構(gòu)造函數(shù)默認(rèn)使用系統(tǒng)的編碼方式,如果文件內(nèi)容與系統(tǒng)編碼方式不一致,可能會(huì)出現(xiàn)亂碼。 在這種情況下,建議使用FileReader和FileWriter的父類(lèi): InputStreamReader/OutputStreamWriter,它們也是基于字符的,但在構(gòu)造函數(shù)中可以指定編碼類(lèi)型: InputStreamReader(InputStream in, Charset cs) 和OutputStreamWriter(OutputStream out, Charset cs)。

          4、其他
          上 面提到的方法應(yīng)該能解決大部分亂碼問(wèn)題,如果在其他地方還出現(xiàn)亂碼,可能需要手動(dòng)修改代碼。解決Java亂碼問(wèn)題的關(guān)鍵在于在字節(jié)與字符的轉(zhuǎn)換過(guò)程中,你 必須知道原來(lái)字節(jié)或轉(zhuǎn)換后的字節(jié)的編碼方式,轉(zhuǎn)換時(shí)采用的編碼必須與這個(gè)編碼方式保持一致。我們以前使用Resin服務(wù)器,使用smartUpload組 件上傳文件,上傳文件同時(shí)傳遞的中文參數(shù)獲取沒(méi)有亂碼問(wèn)題。當(dāng)在Linux中把Resin設(shè)置成服務(wù)后,上傳文件同時(shí)的中文參數(shù)獲取出現(xiàn)了亂碼。這個(gè)問(wèn)題 困擾了我們很久,后來(lái)我們分析smartUpload組件的源文件,因?yàn)槲募蟼鞑捎玫氖亲止?jié)流的方式,里面包含的參數(shù)名稱(chēng)和值也是字節(jié)流的方式傳遞的。 smartUpload組件讀取字節(jié)流后再將參數(shù)名稱(chēng)和值從字節(jié)流中解析出來(lái),問(wèn)題就出現(xiàn)在smartUpload將字節(jié)流轉(zhuǎn)換成字符串時(shí)采用了系統(tǒng)默認(rèn) 的編碼,而將Resin設(shè)置成服務(wù)后,系統(tǒng)默認(rèn)的編碼可能發(fā)生了改變,因此出現(xiàn)了亂碼。后來(lái),我們更改了smartUpload的源文件,增加了一個(gè)屬性 charset和setCharset(String)方法,將upload()方法中提取參數(shù)語(yǔ)句:
          String value = new String(m_binArray, m_startData, (m_endData - m_startData) + 1 );
          改成了
          String value = new String(m_binArray, m_startData, (m_endData - m_startData) + 1, charset );
          終于解決了這個(gè)亂碼問(wèn)題。

          posted on 2008-01-10 14:03 李建軍 閱讀(772) 評(píng)論(1)  編輯  收藏 所屬分類(lèi): jsp

          FeedBack:
          # re: JSP中文亂碼問(wèn)題解決心得[未登錄](méi)
          2008-01-25 16:11 | gg

          <2008年1月>
          303112345
          6789101112
          13141516171819
          20212223242526
          272829303112
          3456789

          留言簿(1)

          文章分類(lèi)

          文章檔案

          搜索

          •  

          最新評(píng)論

          主站蜘蛛池模板: 宣化县| 莱州市| 城固县| 苏尼特右旗| 嫩江县| 长沙市| 广东省| 红河县| 桦川县| 宣恩县| 江油市| 嵩明县| 丽水市| 金溪县| 贺州市| 武鸣县| 堆龙德庆县| 正蓝旗| 肥东县| 高雄市| 彭阳县| 湖北省| 淳安县| 石河子市| 梧州市| 唐海县| 咸阳市| 建湖县| 江门市| 房产| 淮北市| 云浮市| 靖边县| 滦南县| 松江区| 永春县| 中牟县| 鄂州市| 神农架林区| 宣汉县| 福泉市|