python读取中文字符编码问题

浏览数：22 / 时间：2015年06月08日

preface:许久没遇到过编码问题，一没注意就被绊倒脚了。。

一、编辑器是以ASICC编码格式的，若想在程序中有中文，需要改为utf-8格式，加入如下代码可破：

<span style="font-size:18px;">import sys  
reload(sys)  
sys.setdefaultencoding('utf8')  </span>

或者参考卤主转载的这篇http://blog.csdn.net/u010454729/article/details/40476015，另外一种方式可破。

二、读取中文文档时，卤主天真的以为字符长度是根据中文长度来着，但是读入后发现是根据字符长度来着，一个中文字长度字符长度为3。发现codecs可破：

<span style="font-size:18px;">import codecs
with codecs.open("XXX.txt", encoding = "utf-8") as f:
    text  =  f.readlines()
for i in text:
    i = i.strip("\n")
    print i,len(i)</span>

郑重声明：本站内容如果来自互联网及其他传播媒体，其版权均属原媒体及文章作者所有。转载目的在于传递更多信息及用于网络分享，并不代表本站赞同其观点和对其真实性负责，也不构成任何其他建议。

python读取中文字符编码问题

标签：编程语言 Java C C# Javascript js Python Ruby Spring 程序 VB

python读取中文字符编码问题

相关文章

随机文章

您可能还喜欢

您可能还喜欢

最新图文

您可能还喜欢

您可能还喜欢

文摘排行

文章排行

推荐文章

图文排行

推荐图文