作者peace9527 (谢谢你9527)
看板Python
标题[问题] Beautifulsoup的get_text()问题
时间Sat Jan 30 10:45:15 2016
昨天用BeautifulSoup(BS)的get_text()成功抓取网页资料
但是问题出现了
我抓的网站是简体字网站
但是用get_text()抓出来的是像这样的资料:
b'/x56/x34/x49/x04'
我查看了一下他的资料型态是bytes
网页的编码是UTF-8 我电脑的预设编码也是UTF-8
我想把这个资料转成用原本的简体字显示 请问有办法吗?
感谢各位大神的帮忙!
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 111.82.222.141
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1454121918.A.4E3.html
1F:推 ocean5566: decode 01/30 17:47
2F:→ peace9527: 不过他内容前面有个b 需要把他变成u再decode吗? 01/30 21:42
3F:→ ccwang002: b'...' 表示是 bytes,就直接 decode 不用什麽 u 01/31 02:12