作者left (881 forever)
看板Python
标题再问一个xpath怎麽下的问题
时间Tue Oct 21 16:59:45 2014
对Xpath还不是很熟 还想要再请教一下各位大大
以下面连结为例好了
https://webptt.com/cn.aspx?n=bbs/Boy-Girl/M.1413814957.A.704.html
我的需求是想要抓ptt里本文的部分(作者po文 但不包含推嘘文的部分)
以这个例来说会包含
白色字+ 绿色字+签名档的部分
我的想法是:
1.先找到可以包住整个po文以及推嘘文的node集合(S)
//*[@id="main-content”]
2.然後定出终止的node(p)
/html/body/div[@id="main-container"]/div[@id="main-content"]/span[@class="f2" and text()="※ 文章网址:
“]
然後....就卡住了
我的问题是要怎麽下xpath 就可以直接在S里抓出终止点之前所有的node啊?
--
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 140.112.218.124
※ 文章网址: http://webptt.com/cn.aspx?n=bbs/Python/M.1413881989.A.929.html