作者jamesxxx1997 (黄~)
看板Python
标题[心得] 终於把蔡XX网站的影片爬下来了~心得分享~
时间Sun Jan 28 16:12:44 2018
大家好,这是我之前下载影片时碰到的困境
https://goo.gl/rs7tQG
发现解法了!!!
其实完全不用管segment,其实网站把影片url藏在iframe的javascript中
那我是怎麽找到的呢?
直接在chrome dev tools的element中ctrl+F,打上.mp4!!!
https://imgur.com/a/eizXW
以下是我的程式码(别忘了driver.switch_to.frame(0)来抓iframe中的javascript原始码)
https://pastebin.com/BwWZ71m4
谢谢!!!
PS1.看完大数学堂了,不过针对scrapy有些比较难的部分(ex.downloader middleware)
只有找到几支免费的教学影片,还有人推荐吗?感谢!
PS2.有人有其他进阶的爬虫下载教学,也欢迎分享!!!
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 111.82.26.105
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1517127167.A.88D.html
1F:→ vi000246: scrapy直接看官方文件 或是买书吧 01/28 21:40
2F:→ jamesxxx1997: 官方文件有时候看不太懂ㄝ 01/28 23:40
3F:→ jamesxxx1997: 影片比较容易吸收~ 01/28 23:41
4F:推 modelfucker: 那如果影片的src是没有副档名的呢? 02/02 20:42
5F:→ modelfucker: 来源点进去都是直接access denied这种我搞好久还是 02/02 20:42
6F:→ modelfucker: 都抓不下来 02/02 20:42