月上千秋河
靜風流云之揮意舒達—殘賤

隨筆-46 評論-54 文章-0 trackbacks-0

第一，存文件必須以一種編碼存；讀文件也必須以一種編碼讀，如不特別設置，去系統(tǒng)默認的編碼，中文windows為GBK編碼。

從.java->.class過程是，先編寫.java文件并按莫種編碼方式保存，然后用javac方法編譯此文件，注意如.java沒按系統(tǒng)默認編碼保存則要帶encoding參數(shù)指明實際編碼，否則出錯，生成的.class文件存為系統(tǒng)默認編碼。

從.jsp->.java->.class，先存為某種編碼的.jsp文件，然后tomcat根據(jù)pageEncoding讀取并轉化為servlet存為系統(tǒng)默認編碼，然后同上面.java->.class過程。

第二，IDE的encoding為對系統(tǒng)下文件打開的解碼方式或保存的編碼方式。特例：如果.jsp文件有<%@ page language="java" pageEncoding="UTF-8"%>，則eclipse會自動存為UTF-8方式，不管eclipse的encoding是什么，這也是eclipse的聰明之處。

第三，
pageEncoding="UTF-8"表示此文件的編碼方式，必須與此文件存儲方式一致（所以eclipse會首選根據(jù)它來存文件），tomcat根據(jù)這個來讀此.jsp文件并編譯為servlet。
contentType="text/html;charset=UTF-8"表示當瀏覽器得到此文件時以什么方式解碼。例如：
<%@ page language="java" pageEncoding="UTF-8"%>
<%@ page contentType="text/html;charset=iso8859-1"%>
<html>
<head>
<title>test</title>
</head>
<body>
我是個好人
</body>
</html>
會產生亂碼，因為存為UTF-8的文件被解碼為iso8859-1，這樣如有中文肯定出亂碼。

至此，頁面應為：
<%@ page language="java" pageEncoding="UTF-8"%>
<%@ page contentType="text/html;charset=UTF-8"%>
<html>
<head>
<title>中文問題</title>
<meta http-equiv="Content-Type" content="text/html; charset=UTF-8">
</head>
</html>

第四，
request.setCharacterEncoding("UTF-8")是把提交內容的字符集設為UTF－8
response.setCharacterEncoding("UTF-8")可以把頁面中的<%@ page contentType="text/html;charset=iso8859-1"%>換為charset=UTF-8，是給告訴瀏覽器我這個文件的編碼方式。

第五，表單提交：無論何種表單提交都可以在后臺的java文件中通過String des = new String(s.getBytes("iso8859-1"),"UTF-8");來轉換成你想要的UTF－8編碼方式。但如果每處都加詞句太麻煩，故分post和get兩種方式區(qū)分提交（tomcat5以后分開處理，之前處理方式一樣，即都可以用request.setCharacterEncoding("UTF-8")方法處理，不過tomcat5以后get提交方法用此語句無效）。
1,post提交的數(shù)據(jù):
程序加上org.springframework.web.filter.CharacterEncodingFilter過濾器.
<filter>
<filter-name>encodingFilter</filter-name>
<filter-class>org.springframework.web.filter.CharacterEncodingFilter</filter-class>
<init-param>
<param-name>encoding</param-name>
<param-value>UTF8</param-value>
</init-param>
<init-param>
<param-name>forceEncoding</param-name>
<param-value>true</param-value>
</init-param>
</filter>

<filter-mapping>
<filter-name>encodingFilter</filter-name>
<url-pattern>*.html</url-pattern>
</filter-mapping>
<filter-mapping>
<filter-name>encodingFilter</filter-name>
<url-pattern>*.jsp</url-pattern>
</filter-mapping>

因為規(guī)范要求瀏覽器提交數(shù)據(jù)都要用utf8編碼,所以這里設置編碼方式為UTF8.

特別注意:
a,這個過濾器只是簡單的調用:request.setCharacterEncoding(this.encoding);
在這個語句之前不能調用任何的request.getParameter()方法,否則會設置tomcat的缺省字符集為"ISO-8859-1",并且使setCharacterEncoding的調用失效.所以在這個過濾器之前的過濾器中不能有對getParameter這類方法的調用,比較安全的做法就是把這個過濾器盡量靠前放.
b,在server.xml中不能加上<Valve className="org.apache.catalina.valves.RequestDumperValve"/>
這個value也設置tomcat的缺省字符集為"ISO-8859-1",使setCharacterEncoding的調用失效.可能其他的value也有這個問題,我沒有測試過.
如果要觀察http請求參數(shù),可以考慮用過濾器或者其他工具,例如ethereal(http://www.ethereal.com/)

2,get提交的數(shù)據(jù):
兩種情況:
a,如果從地址欄直接輸入漢字,則一般編碼為"GBK",需要用
new String(request.getParameter("something").getBytes("ISO-8859-1"),"GBK")
取出
b,如果是頁面超連接連接中帶的漢字,則編碼根據(jù)頁面編碼的不同而不同,如果頁面的
content="text/html; charset=utf-8",則在tomcat/conf/server.xml中的配置文件中:

<Connector port="8080"
maxThreads="150" minSpareThreads="25" maxSpareThreads="75"
enableLookups="false" redirectPort="8443" acceptCount="100"
debug="0" connectionTimeout="20000" useBodyEncodingForURI="true"
disableUploadTimeout="true" />

加上:useBodyEncodingForURI="true"即可正常使用getParameter取出正確內容.
如果content="text/html; charset=GBK",需用
new String(request.getParameter("something").getBytes("ISO-8859-1"),"GBK")
取出,其他情況類似.

總結:
1,所有頁面使用utf8編碼,
2,服務器加上過濾器,
3,server.xml中不要使用
<Valve className="org.apache.catalina.valves.RequestDumperValve"/>
4,server.xml文件加上useBodyEncodingForURI="true"
這樣應該可以搞定大多數(shù)前臺的中文問題.至于地址欄輸入中文,不支持也罷,一般的程序很少要求
從這里輸入.

第六，連接數(shù)據(jù)庫

1、mysql配置文件：
修改mysql在windowsmy.ini里default-character-set=utf-8

2、mysql里數(shù)據(jù)庫和表也都設為utf8_unicode_ci

3、數(shù)據(jù)庫連結：jdbc:mysql://localhost/mydb?useUnicode=true&characterEncoding=utf-8
注意，關鍵就在于此：此句中間是'&'不是'&'這是因為數(shù)據(jù)庫連結時，在.jsp和.java文件中應該用&號，而XML文件中需要用&amp

posted on 2010-01-05 08:43 rox 閱讀(441) 評論(0) 編輯收藏

新用戶注冊刷新評論列表


只有注冊用戶登錄后才能發(fā)表評論。




網站導航: 博客園 IT新聞 Chat2DB C++博客博問管理

<

2010年1月

>

日

一

二

三

四

五

六

27

28

29

30

31

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

27

28

29

30

31

1

2

3

4

5

6

常用鏈接

留言簿(3)

隨筆分類(30)

隨筆檔案(47)

一些達人！

分享——知識與快樂 pragmatic programmer: programming for fun and money 不管是什么風，歡迎您的到來！自我介紹我現(xiàn)在上海某公司擔任軟件設計師，愛好軟件設計，架構和設計模式等。涉及EAI, ERP, SCM, DCM等。歡迎批評建議，共尋合作機會，共創(chuàng)美好未來！
cnJava 的BLOG
又一個Java牛人！
Java Security高手，常常會出些題目。
Java Security 視野，平臺，戰(zhàn)略
JBoss Rules(Drools) 學習筆記
記錄學習JBoss Rules的點點滴滴
jini(99% jakarta)的 Blog
jini(99% jakarta)雅加達爪哇咖啡臺灣總店
SenTom，源自“盛唐”！
SenTom，源自“盛唐”，致力于Java開源項目在中國的推廣，以及文檔中文化！ SenTom，非營利站點，只希望能為 Java Open Source 社區(qū)貢獻一點力量！如果你愿意支持我們：可以在你的網站為SenTom做一個連接；可以向我們推薦你知道的Java開源項目；可以向我們推薦你閱讀過的Java開源項目技術文章；可以向我們提供你撰寫的Java開源項目技術文章；聯(lián)系email:wayne@sentom.net
xheaven的專欄
又一個DB4O的達人！
一個Ruby達人
http://ruby-cn.org/的站長，翻譯了不少文檔了。牛人一個。
東波'S BLOG
生活，學習，工作的一點看法，想法
利我博客
利我博客，達人，絕對的達人。
孤獨鍵盤手
BlogJava-xmatthew
干煸四季豆
給我一支煙，吞云吐霧間，讓所有煩累疲勞能夠過往如云煙~~~ 我的能力是協(xié)助團隊取得成功并盡快掌握新知識。
成都心情
成都心情技術本身沒有優(yōu)良，只有不良的設計和應用。本 Blog 是從：http://blog.csdn.net/rosen 搬來。
陳剛的BLOG
子在川上曰逝者如斯夫不舍晝夜

優(yōu)秀個人

Java 愛好者
http://blog.matrix.org.cn/page/icess/與我聯(lián)系資料收集的蠻多、蠻不錯。
操作系統(tǒng)版Flash作品
一起研究Flash！ http://www.kingnare.com/blog/
狐貍的BLOG，關注用戶體驗和頁面前端開發(fā)..歡迎交流。。
自動截取字符長度添加省略號的一段js

優(yōu)秀資源

Free Java Books
很多免費的Java Book的鏈接。
Java年鑒
大量的Java樣例代碼
Max On Java
ProGuard Java Optimizer and Obfuscator
好吃 - 美味工廠[懶人菜譜分享]
阿諾的美味工廠
愛百科,可信賴的中文百科全書,ipedia.org.cn
愛百科,可信賴的中文百科全書,內容豐富翔實的中國中文的百科全書,ipedia.org.cn