作者left (881 forever)
看板Python
标题[问题] crawl http://www.netgear.com/
时间Wed Jun 25 09:11:51 2014
问一下各位高手
因为被指定一个task
就是crawl
http://www.netgear.com/
这个网站里面的相关资讯,就是给一个关键字
然後把文章拉出来
因为里面有一个search bar可以提供搜寻
我的想法是:
先键入关键字後
再从他的吐出来的结果,在去抓网址然後再下载thread
可是吐出来的结果完全找不到网址
各位大大有什麽好的想法与建议吗?
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 140.112.218.124
※ 文章网址: http://webptt.com/cn.aspx?n=bbs/Python/M.1403658714.A.0EF.html
1F:→ uranusjr:因为它的结果是用 AJAX 插入的, 稍微搜寻一下相关资料吧 06/25 10:35
2F:→ huggie:麻烦一点,要直接找到他 AJAX 运作的 HTTP method & URL 06/29 12:00
3F:→ huggie:或者可能简单点直接用 Selenium 驱动 browser 06/29 12:02