作者skyivan (官人)
看板Python
标题[问题] 爬虫遇到一样的class如何筛选
时间Thu Aug 31 16:31:03 2017
各位好,我看书试着依样画葫芦抓台彩首页的开奖号码
抓威力彩可以,但想抓大乐透时遇到问题
仔细一看发现有好几种商品的class都是contents_box02,用find只能得到第一个
只抓得到威力彩
用find_all可以同时找到好几个商品
但不知道如何只抓第三个class为contents_box02的div
想请教如何处理,程式码如下
import requests
from bs4 import BeautifulSoup
url="
http://www.taiwanlottery.com.tw"
html=requests.get(url)
sp=BeautifulSoup(html.text, 'html.parser') #解析原始码
data1=sp.find_all('div',{'class':'contents_box02'})
print(data1)
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 123.51.219.89
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1504168267.A.3F5.html
1F:推 blue14753: print(data1[2]) ? 08/31 16:41
2F:→ wennie0433: 换个html5lib or lxml 解析看看 08/31 22:14
3F:推 coeric: print(data1[2]) 即可 09/01 11:02
4F:→ skyivan: 原来这麽简单...问题解决了,感谢楼上几位的回答 09/01 11:22