作者ggirls (哥)
看板Python
标题[问题] lxml.html 中文 URL 的乱码问题
时间Fri Oct 7 21:48:31 2016
import lxml.html
e = lxml.html.fromstring('<a name="中文">什麽</a>')
print(lxml.html.tostring(e, encoding='unicode'))
结果
<a name="%E4%B8%AD%E6%96%87">什麽</a>
URL 的部分都被转码了。虽然这应该是符合规格。
可办法叫他不要转吗?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 223.136.175.128
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1475848114.A.48B.html
1F:推 longlongint: 如果你不会用到HTTP 就不用转 10/08 01:00
2F:→ s860134: urllib.parse.unquote(result) 好险你用 python3 10/08 01:00
3F:→ s860134: 如果你用 python2 你会有点恼地抄一段 \Lib\urlparse.py 10/08 01:02