作者alair99 (I think home)
看板Python
标题[问题]文字转成html编码的问题
时间Wed Sep 23 17:30:33 2015
大家好
请问一下上面有一撇的e (以下以e撇称呼)
也就是
http://goo.gl/l4WVwv 里的编号 U+00E9
我在excel里面读到e撇 encode成utf-8之後变成 \xc3\xa9
但我要怎麽把它再转成e撇输出到txt的文字档案呢?
谢谢 :)
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 140.114.69.226
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1443000638.A.5A3.html
1F:推 tiefblau: py2 or 3? 3的话 b'\xc3\xa9'.decode('utf8') 09/23 17:46
2F:→ tiefblau: 2好像直接print就好? 09/23 17:49
3F:→ alair99: 好的,我再试一下,谢谢罗 :) 09/24 08:32
※ 编辑: alair99 (140.114.69.226), 09/24/2015 14:16:22
4F:→ alair99: 後来使用 namedentities 套件来把e撇转换成 é 09/24 14:19
5F:→ alair99: 这样才能让网页真正呈现出e撇的文字 09/24 14:19
6F:→ alair99: 语法是 repr(named_entities(string)) 09/24 14:20