作者cow1487 (天空之城)
看板Python
标题[问题] 新手发问
时间Sun May 29 18:56:31 2016
小弟目前刚刚开始在学习爬虫,可以抓取到附图的超连结,但不知道如何将後面的一些文
字(标题、发布时间、发布的地点等...)抓取下来,网站本身结构有些复杂,不能单单用
标签抓下来,经过发问之後,得到的回应是能透过URL定位资讯後,再透过(例
:20+[span-title].length+2)将位置定下来,之後透过回圈抓取资料,但不知道该如何下
手,来此请求各位大大的帮助。
http://screenshot.net/0ol0vs3?tw
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 134.208.97.130
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1464519394.A.D5D.html
※ 编辑: cow1487 (134.208.97.130), 05/29/2016 19:01:15
1F:→ kenduest: 用 BeautifulSoup 拆解网页内容会单纯很多 05/29 19:10