作者kantaco (我一直都在)
看板Python
标题Re: [问题] 请问会自动更新的网页资料要怎麽抓?
时间Thu Aug 20 21:14:44 2015
※ 引述《kantaco (我一直都在)》之铭言:
: 想要纪录台湾每日发电/用电量
: 在台电的网页
: http://www.taipower.com.tw/loadGraph/loadGraph/load_areas.html
感谢ENEP提点
在网页中找到
data_file: encodeURIComponent("data/loadareas.csv"),
将网址换成
http://www.taipower.com.tw/loadGraph/loadGraph/data/loadareas.csv
就能读到资料了 :)
data_txt = soup.text.replace('\r\n', ',') # 取出文字(字串),
# 并使用置换把换行符号换成逗号
data = data_txt.split(',') # 将资料用逗号分隔成 list
# data : time, 东, 南, 中, 北
tt = []
east_load = []
south_load = []
central_load = []
north_load = []
# 单位 万瓩
for i in range(0, int(len(data) / 5)):
if data[i] != '':
tt.append(data[i * 5])
east_load.append(data[i * 5 + 1])
south_load.append(data[i * 5 + 2])
central_load.append(data[i * 5 + 3])
north_load.append(data[i * 5 + 4])
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 118.169.210.4
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1440076488.A.5FB.html
1F:推 wadd: 越来越多使用者在解完後能更新正确解法,太赞了 08/21 10:17
2F:推 cybelia: 来个推 08/22 10:14
3F:推 ninggo: 推 08/29 02:20