作者tommy780507 (巴柏)
看板Python
标题[问题] 编码问题求救
时间Sat Feb 4 19:46:27 2017
不好意思!! 小弟为新手
在JIEBA断词的过程中遇到编码的问题
想请教一下各位高手,是否有方法可以解决或是我哪里没注意到
麻烦提点一下
程式码:
#-*- coding: utf-8 -*-
# -*- coding: cp950 -*-
import jieba
jieba.set_dictionary('dict.txt.big')
ret = open ('speech.txt', "r",encoding = 'utf-8').read()
seglist = jieba.cut(ret, cut_all=False)
import json
hash = {}
for item in seglist:
if item in hash:
hash[item] += 1
else:
hash[item] = 1
json.dump(hash,open("count.json","w",encoding ='utf-8'),ensure_ascii=False)
fd = open("count.csv","w",encoding ='utf-8')
fd.write("word,count\n")
for k in hash:
fd.write("%s,%d\n"%(k.encode("utf8"),hash[k]))------>目前已经查出为这行程式的问题
但不知道如何修改可以输出成中文,依照目前程式输出为ASCII的编码
拜托了~~
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 111.250.159.33
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1486208790.A.AC3.html
1F:推 ckc1ark: open指定encoding='utf-8'了 write的时候拿掉encode试试 02/04 20:39
2F:→ tommy780507: 谢谢楼上 问题解决了!! 但我可以问一下 原因吗? 02/04 22:15
3F:推 GoalBased: 你知道py3妈 02/05 02:50
4F:→ tommy780507: 没有 我来研究一下 02/05 15:37
5F:推 chehsunliu: 推py3,好用明了 02/05 19:32