posts - 73,  comments - 55,  trackbacks - 0

          第一, 文件的的編碼方式其實就包括兩方面:存和取, 存文件必須以一種編碼存;讀文件也必須以一種編碼讀。 如果存取按照相同的編碼方式,則不會有問題,關鍵就是很多時候存取的方式不一致,產生亂碼。 ,如不特別設置取系統默認的編碼,中文windows為GBK編碼。

          從.java->.class過程是,先編寫.java文件并按莫種編碼方式保存,然后用javac方法編譯此文件,注意如.java沒按系統默認編碼保存則要帶encoding參數指明實際編碼,否則出錯,生成的.class文件存為系統默認編碼。

          從.jsp->.java->.class,先存為某種編碼的.jsp文件,然后tomcat根據pageEncoding讀取并轉化為servlet存為系統默認編碼,然后同上面.java->.class過程。

          第二,IDE的encoding為對系統下文件打開的解碼方式或保存的編碼方式。特例:如果.jsp文件有<%@ page language="java" pageEncoding="UTF-8"%>,則eclipse會自動存為UTF-8方式,不管eclipse的encoding是什么,這也是eclipse的聰明之處。

          第三,
          pageEncoding="UTF-8"表示此文件的編碼方式,必須與此文件存儲方式一致(所以eclipse會首選根據它來存文件),tomcat根據這個來讀此.jsp文件并編譯為servlet(至于編譯成的.java和.class文件應該為tomcat服務器默認編碼)。
          contentType="text/html;charset=UTF-8"表示當服務器給瀏覽器傳頁面文件時編碼方式為UTF-8,形式為HTML。例如:
          <%@ page language="java" pageEncoding="UTF-8"%>
          <%@ page contentType="text/html;charset=GBK"%>
          <html>
          ?<head>
          ??<title>test</title>
          ?</head>
          ?<body>
          ??我是個好人
          ?</body>
          </html>

          表示本jsp文件存為UTF-8字符集,當瀏覽器打開此頁面后,查看原碼就會發現源碼為GBK字符集。

          第四,
          request.setCharacterEncoding("UTF-8")是把提交內容的字符集設為UTF-8
          response.setCharacterEncoding("UTF-8")可以把頁面中的<%@ page contentType="text/html;charset=iso8859-1"%>換為charset=UTF-8,是給告訴瀏覽器我這個文件的編碼方式。

          第五,表單提交:無論何種表單提交都可以在后臺的java文件中通過String des = new String(s.getBytes("iso8859-1"),"UTF-8");來轉換成你想要的UTF-8編碼方式。但如果每處都加詞句太麻煩,故分post和get兩種方式區分提交(tomcat5以后分開處理,之前處理方式一樣,即都可以用request.setCharacterEncoding("UTF-8")方法處理,不過tomcat5以后get提交方法用此語句無效)。
          1,post提交的數據:
          程序加上org.springframework.web.filter.CharacterEncodingFilter過濾器.
          <filter>
          <filter-name>encodingFilter</filter-name>
          <filter-class>org.springframework.web.filter.CharacterEncodingFilter</filter-class>
          <init-param>
          <param-name>encoding</param-name>
          <param-value>UTF8</param-value>
          </init-param>
          <init-param>
          <param-name>forceEncoding</param-name>
          <param-value>true</param-value>
          </init-param>
          </filter>

          <filter-mapping>
          <filter-name>encodingFilter</filter-name>
          <url-pattern>*.html</url-pattern>
          </filter-mapping>
          <filter-mapping>
          <filter-name>encodingFilter</filter-name>
          <url-pattern>*.jsp</url-pattern>
          </filter-mapping>

          因為規范要求瀏覽器提交數據都要用utf8編碼,所以這里設置編碼方式為UTF8.

          特別注意:
          a,這個過濾器只是簡單的調用:request.setCharacterEncoding(this.encoding);
          在這個語句之前不能調用任何的request.getParameter()方法,否則會設置tomcat的缺省字符集為"ISO-8859-1",并且使setCharacterEncoding的調用失效.所以在這個過濾器之前的過濾器中不能有對getParameter這類方法的調用,比較安全的做法就是把這個過濾器盡量靠前放.
          b,在server.xml中不能加上<Valve className="org.apache.catalina.valves.RequestDumperValve"/>
          這個value也設置tomcat的缺省字符集為"ISO-8859-1",使setCharacterEncoding的調用失效.可能其他的value也有這個問題,我沒有測試過.
          如果要觀察http請求參數,可以考慮用過濾器或者其他工具,例如ethereal(http://www.ethereal.com/)

          2,get提交的數據:
          兩種情況:
          a,如果從地址欄直接輸入漢字,則一般編碼為"GBK",需要用
          new String(request.getParameter("something").getBytes("ISO-8859-1"),"GBK")
          取出
          b,如果是頁面超連接連接中帶的漢字,則編碼根據頁面編碼的不同而不同,如果頁面的
          content="text/html; charset=utf-8",則在tomcat/conf/server.xml中的配置文件中:
          <!-- Define a non-SSL Coyote HTTP/1.1 Connector on port 8080 -->
          <Connector port="8080"
          maxThreads="150" minSpareThreads="25" maxSpareThreads="75"
          enableLookups="false" redirectPort="8443" acceptCount="100"
          debug="0" connectionTimeout="20000" useBodyEncodingForURI="true"
          disableUploadTimeout="true" />

          加上:useBodyEncodingForURI="true"即可正常使用getParameter取出正確內容.
          如果content="text/html; charset=GBK",需用
          new String(request.getParameter("something").getBytes("ISO-8859-1"),"GBK")
          取出,其他情況類似.

          總結:
          1,所有頁面使用utf8編碼,
          2,服務器加上過濾器,
          3,server.xml中不要使用
          <Valve className="org.apache.catalina.valves.RequestDumperValve"/>
          4,server.xml文件加上useBodyEncodingForURI="true"
          這樣應該可以搞定大多數前臺的中文問題.至于地址欄輸入中文,不支持也罷,一般的程序很少要求
          從這里輸入.

          第六,連接數據庫
          ?

          1、mysql配置文件:
          修改mysql在windows\my.ini里default-character-set=utf-8

          2、mysql里數據庫和表也都設為utf8_unicode_ci

          3、數據庫連結:jdbc:mysql://localhost/mydb?useUnicode=true&characterEncoding=utf-8
          注意,關鍵就在于此:此句中間是'&'不是'&amp;'這是因為數據庫連結時,在.jsp和.java文件中應該用&號,而XML文件中需要用&amp

          posted on 2006-09-05 16:06 保爾任 閱讀(800) 評論(0)  編輯  收藏

          只有注冊用戶登錄后才能發表評論。


          網站導航:
           

          <2025年5月>
          27282930123
          45678910
          11121314151617
          18192021222324
          25262728293031
          1234567

          常用鏈接

          留言簿(4)

          隨筆分類

          隨筆檔案

          文章分類

          文章檔案

          搜索

          •  

          最新評論

          閱讀排行榜

          評論排行榜

          主站蜘蛛池模板: 哈密市| 泸西县| 新平| 青海省| 喀喇| 巴东县| 建水县| 石柱| 吴桥县| 鄂伦春自治旗| 西藏| 恭城| 彩票| 延川县| 西安市| 景泰县| 车险| 顺平县| 贺兰县| 舞阳县| 庄河市| 延安市| 商丘市| 手游| 灵宝市| 通辽市| 丹江口市| 邹城市| 房山区| 莱芜市| 榆中县| 怀柔区| 锡林郭勒盟| 甘孜县| 嘉义市| 麦盖提县| 乌兰察布市| 偃师市| 溆浦县| 阆中市| 新兴县|