Re: [OT]在Windows下寫BIG5編 碼的繁體中文文件,有什麽好的 方案

"Jiahua Huang" <[email protected]> Tue, 22 Jan 2008 11:12:37 +0800
Newsgroups gmane.comp.python.chinese
Message-ID <[email protected]>
当然是你的问题啦,
一个个说吧

2008/1/22 fluke.l <[email protected]>:
>
>
> 按照你的说法,是不是说,在gtk下,默认的显示编码就是utf8,kde的是utf16,windows的我知道也是utf16,
>
> 我印象中,utf8和gbk或者big5的编码本身是不兼容的--不像gbk是兼容了gb2312的编码,只是增加了gb2312以外的内容。(现在讨论问题的问题不太严肃,就不去查资料了,上面说的都有可能有错。)
>

这些编码都是转成 utf8 或 utf16 来处理的,你不会不知道转码吧

> 那么我在gedit下,如果使用的是en.utf8的locale(Jiahua你说和locale没关系),我试过默认情况下是不会识别出big5编码的,这个时候,我要怎么去选择让他知道这个是big5的文件呢?
>

截图不是给你发了么, 打开文件对话框里边自己选编码,
要自动识别里加上的话, 打开 gconf-editor 注册表,
照着截图 http://paste.ubuntu.org.cn/i4893.png
修改 /apps/gedit-2/preferences/encodings/auto_detected
加上 自动探测编码

> 我记得(短时间内是不能再现这个情况了,因为我刚换机器,linux还没装)在这个时候,在gedit处选择另存为,文件编码的选项里面,默认是utf8(是不是可以说,他认为文件编码是utf8?),并且,这个时候,显示出来的是乱码的。当然我肯定这个是big5的文件,文件是我在繁体的环境下面写的,并且在香港朋友的服务器上面,他默认是繁体的网站上面显示正常并且浏览器默认识别的也是big5,apache发出的header里面是否有char的信息,我就忘记查了。

你必须打开的时候选择啊, 你都转码转错了,再解码有啥用
>
> 这个时候不能选择用big5去保存,我试过存了以后,文件在big5的环境打开也是乱码的了,大概是因为gedit把这个big5的流,当作utf8,并且使用utf8->big5的算法来转换,所以就成了乱码了。
>

用 python 说吧,
装载的时候会试图 decode(enc),
保存的时候再 encode(enc),
你 decode 都错了,怎么指望 encode 能对


> locale,字体,内码等等问题,其实我自己都不太清楚,不管是不是因为这个问题,找时间研究一下,应该还是有好处的。
>

没必要, 这种"研究" 能玩出什么东西来,


> 另外,简体windows
> xp环境下,editplus打开一个big5的程序,也是和我说的gedit的情况类似,只是editplus默认的保存编码是ansi。
>

一样是你自己注意打开的时候选
_______________________________________________
python-chinese
Post: send [email protected]
Subscribe: send subscribe to [email protected]
Unsubscribe: send unsubscribe to  [email protected]
Detail Info: http://python.cn/mailman/listinfo/python-chinese