作者han999 (卖鸡排的少年)
看板Python
标题[讨论] 本地网页的资料撷取一问?
时间Tue Jan 23 22:54:35 2018
不好意思~
完整的.html档案如连结:
http://0rz.tw/c6ac0
红框所示:
https://i.imgur.com/ANYMQvb.jpg
我的code如连结:
http://0rz.tw/uffH2
print(soup.body.prettify()) # 把 tag 抓出来
print(soup.find("center"))
print(soup.find_all("b"))
上面实作可以撷取到,但是如何撷取像是绿框部分,如下连结:
https://i.imgur.com/OS2l3ql.jpg
恳请指点<(_ _)>
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 1.160.208.123
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1516719280.A.ECD.html
※ 编辑: han999 (1.160.208.123), 01/23/2018 23:07:13
1F:推 HenryLiKing: 拙见: 如果没id之类的话用个数(?) 01/24 16:31
2F:→ HenryLiKing: 或是center底下第几个这样看? 01/24 16:32
3F:→ uranusjr: 或者是一个一个字串比对之类的, 也只能这样了 01/24 16:47
4F:→ han999: /html/body/center/b/font[1] 01/24 22:29
5F:→ han999: /html/body/center/b/font[2] 01/24 22:29
6F:→ han999: /html/body/center/b/font[3] 01/24 22:29
7F:→ han999: 1~3都是我要的,我要怎麽做? 01/24 22:30
8F:→ s860134: xpath following-sibling 可能符合你的需求 01/25 06:00