作者TeachCS (天之教资)
看板Python
标题[问题] 又是爬虫编码问题
时间Sun Jan 15 21:24:02 2017
大家好
我是python新手,
问题是
再爬下列网站时发生编码错误
http://i.imgur.com/n1opHh5.jpg
因为这是专题要用的,
试过cp950 等等...
都不行,
希望各位大大帮个忙
愿意给100p币答谢(小数目 因为穷QQ)
祝各位大大心想事成 万事如意!
-----
Sent from JPTT on my HTC One 801 e.
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 180.217.254.204
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1484486645.A.981.html
1F:推 crazycy: 在requests.get()那行後面加 res.encoding = 'utf-8' ?01/15 21:36
2F:推 oeg: decode可以在BeautifulSoup之前就先处理好01/15 21:36
3F:→ benson415: 1F正解,原Po可以先试试输入req.encoding,会发现是01/15 21:49
4F:→ benson415: 'ISO-8859-1',再用1F改法即可01/15 21:50
感谢各位好心的大大 p币请朋友已送出 3楼req.encoding是怎麽用啊 可以在说详细点吗??
P谢
6F:→ coeric: 原来是学弟.......01/15 22:58
学长好!
7F:→ benson415: 抱歉笔误,因为我自己变数习惯设定req,就看是在terminal01/15 23:00
8F:→ benson415: 直接下res.encoding或直接加一行print(res.encoding)01/15 23:01
了解了谢谢!
※ 编辑: TeachCS (180.217.254.204), 01/15/2017 23:06:54