玩蛇网提供最新Python编程技术信息以及Python资源下载!

win下python新建文件名有ã字符是怎么回事

win下,下面程序:

#! /usr/bin/env python
# coding:utf8
name = '中文ero.txt'
name = name[:].decode('utf-8').encode('gb2312')
f = open(name, 'w')
f.write("正文如下:abcdefVerão")
f.close()

可以正常新建一个带有中文名字的文件,这点可以理解。但是如果文件名包含有ã(鬼知道这是哪国的字符,不过应该不是中文字符,在一个.mp3文件名中看到了这个字符),即

name = '中文eroã.txt'

则出现以下错误:

UnicodeEncodeError: 'gb2312' codec can't encode character u'\xe3' in position 5:
illegal multibyte sequence

应该是因为ã不是中文字符,因此gb2312无法编码它。

但是问题是,为什么直接新建文件时就可以使用这个字符作为文件名呢,并且在控制台dir命令还可以看到这个字符(话说控制台的输出编码不是gb2312吗)。

win7 中文版文件名的内部存储是怎么编码的呢?

-----
还是linux好啊,不用遇见这么蛋疼的问题...

Windows NT内核采用的是UTF-16编码Unicode字符串。
你说遇到的问题只是GB2312覆盖范围太少,请GB18030编码。

补充说明:
文件名完全可以使用unicode字符串:

name = u'中文eroã.txt'
f = open(name, 'w')
-----

玩蛇网文章,转载请注明出处和文章网址:https://www.iplaypy.com/wenda/wd20276.html

相关文章 Recommend

玩蛇网Python互助QQ群,欢迎加入-->: 106381465 玩蛇网Python新手群
修订日期:2017年05月23日 - 11时08分14秒 发布自玩蛇网

您现在的位置: 玩蛇网首页 > Python问题解答 > 正文内容
我要分享到:

必知PYTHON教程 Must Know PYTHON Tutorials

必知PYTHON模块 Must Know PYTHON Modules