作者okeyla (小宝)
看板Python
标题[问题] python网路爬虫,怎麽抓取表格内容
时间Sat Jul 22 00:39:52 2017
我想一次抓取全家便利店全省的商店资讯,
观察到是他以每个县市命名为各自的.php, 然後各县市商店都在对应的php里面.
idea是先抓取各县市的php名称放入list,
再以此list带出各县市的网页, 再取出商店资讯.
目前卡在这儿, 找不着标签...
import requests
from bs4 import BeautifulSoup
res = requests.get('
http://www.allergen.com.tw/famistore.php')
res.encoding = 'utf-8'
#print res.text
soup = BeautifulSoup(res.text)
# 跑个loop挑出famiKeelung.php, famiTaipei.php... etc.
print soup.select('.td') <--- 啊?!
可以指导一下吗???
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 118.160.83.246
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1500655195.A.A78.html
1F:→ AndCycle: 你不熟的东西叫做 css selector 07/22 01:06
3F:→ AlaRduTP: 我会先找table 再找里面的a 07/22 09:00
4F:→ coeric: 里面有json不是? 07/24 12:55