作者jamesxxx1997 (黄~)
看板Python
标题Re: [问题] 在学习程式语言,如何做到有效率的学习
时间Wed Jan 3 22:26:57 2018
感谢大家的回应~在下没有明确的指出问题爬虫问题,是因为我想爬的网页是付费网页
(我是付费会员),有点怕被吉,所以用马赛克马了一部份,不好意思~
以下是在下的步骤
1. 登入"登入"页面>>>
https://imgur.com/a/oHQIY
2. 在网页的上半部点选其中一个选项>>>
https://imgur.com/a/p9Nj9
3. 在网页的下半部会重新载入资料,同样点选其中一个选项>>>
https://imgur.com/a/CFQFO
4. 进入页面>>>碰到有"点击下载的连结时"就不会有问题(selenium),不然就会卡住~
>>>
https://imgur.com/a/GHQ7C
4-1. 检查元素,检查不到影片网址>>>
https://imgur.com/a/pmZKx
4-2. 在network里面看不到档案类型为media的file>>>
https://imgur.com/a/qP6FV
4-1与4-2就是我所碰到的问题的总结
谢谢各位
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 120.110.127.195
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1514989620.A.E09.html
1F:→ f496328mm: 这图也太小了....... 01/03 22:53
2F:推 ckc1ark: m4s就是了吧 content type是video/mp4或audio/mp4 01/03 23:40
3F:→ vi000246: 这个网站我爬过 请去我的github挖宝吧 01/04 00:11
4F:→ vi000246: 提示:vimeo 01/04 00:16
5F:→ Kazimir: 要不然就是先找到影片seg网址的list是什麽时候送过来的 01/04 00:17
6F:→ Kazimir: 否则就是看看能不能直接对seg的网址丢request 01/04 00:18
7F:→ jamesxxx1997: 谢谢v大~真的太赞啦! 01/04 21:33
8F:→ jamesxxx1997: 不过从code看起来,我还有很多要学XD 01/04 21:33
9F:→ jamesxxx1997: K大~请问甚麽是seg? 01/04 21:34
10F:推 Kazimir: 在拨放器已经执行的时候不是有segment-1.m4s吗 01/05 01:13
11F:→ Kazimir: 我之前爬过一个串流是用m3u8装所有segment的网址先传过来 01/05 01:14
12F:→ Kazimir: 然後拨放器再按照顺序去下载这些分割 所以一种方式就是 01/05 01:15
13F:→ Kazimir: 先去找到那个list在哪 解析以後就有所有的网址了 01/05 01:15
14F:→ Kazimir: 另一种假设他的segment完全没加密网址有规律 乾脆直接改 01/05 01:17
15F:→ Kazimir: 网址就好 01/05 01:17