作者qqqa (昵称)
看板Python
标题[问题] 爬虫登入取得query string
时间Wed Apr 12 00:32:06 2017
我是爬重新手目前正在尝试做爬取需要登入才能取得的资料
我用chrome检查元素下去看,要取得的就是图中的query string (access_token)
http://i.imgur.com/K4utu61.jpg
现在是采用requests.get的方法去试,但有点没头绪
要怎样才能捞出那串access_token呢?
观察後发现那串token每隔一段时间都会变,需要那串token才可以继续爬後面的资料
先谢谢大家解答
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 61.227.97.48
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1491928328.A.527.html
1F:推 vi000246: 先get一次 取得token 再get第二次 加上这个token 04/12 01:13
2F:→ zerof: requests.session() 04/12 10:13
感谢回答,但目前仍然无法
我目前用chrome 检查元素,按下登入後,network的XHR地方会跑出
如上图的其中一个element,那里面就有我需要的token
不知道该如何找到
※ 编辑: qqqa (1.175.113.64), 04/12/2017 23:40:37
3F:→ s860134: 跨谋 你上图在哪阿... 04/12 23:54
4F:→ jerry031181: rs=requests.session() 保留session,接下来都用这个 04/13 10:01
5F:→ jerry031181: session去access 04/13 10:02