作者inch446 (inch446)
看板Python
标题[问题] 国图标准中心爬虫
时间Sun Dec 10 21:41:43 2017
小弟第一次接触Python爬虫,
目前需要写一个程式爬国家图书馆标准图书中心的资料,
http://isrc.ncl.edu.tw/search_result_isrc.aspx
即是用一首音乐的ISRC(类似音乐的身分证字号),
去抓该首音乐的资料,如中文歌名、歌、曲、词等,
直接在该网站搜寻的结果如下图,
https://i.imgur.com/gQnrkbS.png
但小弟在网路上都找不到类似的专案,
请问各位大大该如何下手是好?谢谢!
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 114.35.8.54
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1512913321.A.827.html
1F:→ vi000246: 这个很简单啊 去google requests的get用法吧 12/10 23:23
2F:→ ckvir: 先理解一下http 运作吧 12/11 00:19
3F:→ zo6596001: 正好是用GET方法,把url最後的"search_string="改成 12/12 03:15
4F:→ zo6596001: 你要的字串就好。 这样应该可以收到HTML。 12/12 03:16
5F:→ zo6596001: 剩下只要解析HTML的资料就好。 12/12 03:17
谢谢各位大大~已经成功抓到资料了
※ 编辑: inch446 (114.35.8.54), 12/12/2017 13:32:23