作者wxyy (装笑帏)
看板Python
标题Re: [问题] 爬虫 如何爬指定资料
时间Sat Feb 18 16:30:53 2017
※ 引述《a856479 (thebelief)》之铭言:
: 大家好,由於我没有程式语言的基础
: 最近试着爬网页资料时遇到一个问题不知道怎麽解决
: 请求各位协助帮忙,谢谢!
: 目标网址:https://goo.gl/02M292
: 目标资料:只要"今日十全战法偏多"里面出现的股票名称
: 问题:我找不出"今日十全战法偏多"的class或能定义它的方式,
: 导致只能抓取到网页内所有的股票名称...
: ----------以下是我目前的写法----------
: import requests
: from bs4 import BeautifulSoup
: res = requests.get("http://www.sohowgood.com/TwStock/PowerKLine.aspx")
: soup = BeautifulSoup(res.text, "lxml")
: stocks = soup.find_all('li')
: for stock in stocks:
: meta = stock.find('a')
: stockid = meta.getText().strip()
: print(stockid)
: 请问我该如何修改才能抓取到我需要的部分? 谢谢大家
我用了 PyQuery
https://pypi.python.org/pypi/pyquery
from pyquery import PyQuery as pq
d = pq(url="
http://www.sohowgood.com/TwStock/PowerKLine.aspx")
lis = d('h2:contains("今日十全战法偏多") ~ ul li a')
for li in lis:
print(li.attrib['title'])
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 221.224.213.130
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1487406657.A.C6C.html
1F:→ a856479: 感谢Wxyy大提供不同方法! 原本只试过BeautifulSoup而已 02/18 22:31