作者smilekerker (科科:))
看板Python
标题[问题] 抓取网页html source code?
时间Fri Jan 23 18:10:04 2015
刚要学怎麽抓网页source code
再来解析自己要的资讯
结果第一步抓code就死掉了= =
譬如我想抓的网页是PCHOME 股市的某页
http://pchome.megatime.com.tw/rank/sto0/ock03.html
然後写了这个小程式
http://imgur.com/cMjJRCR
但是回传只有这样的讯息
http://imgur.com/UWLSyIH
请问这样是哪里有错误吗?
还是这网页不能这样读?
麻烦指点一下
谢谢 :)
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 140.116.187.212
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1422007806.A.A3C.html
1F:→ uranusjr: 网上搜寻 ajax 01/23 18:53
2F:→ smilekerker: 这是ajax的特殊语法吗? 那我再去查查 谢谢 :) 01/23 19:16
3F:推 secondsee: 这个网址就是只会吐这段html给你,你所看到的东西是因为 01/23 19:23
4F:→ secondsee: browser去执行了里面的javascript改写到了原本的body 01/23 19:24
5F:→ smilekerker: 好的,看来是这样QQ,那有其他快速简洁的方法可以 01/23 19:36
6F:→ smilekerker: 获得原始码的吗? 01/23 19:36
7F:→ secondsee: urllib2.urlopen(url,'is_check=1').read() 01/23 19:48
8F:→ smilekerker: 居然这麽简单!! 万分感谢!! 01/23 19:52