作者NikonD800E (D800E)
看板Python
标题[问题] 字串中符号处理问题
时间Mon Aug 1 18:03:35 2016
小弟最近在练习Python抓资料与字串处理的问题
发现抓下来的文字不知道该如何赋予三引号强制变为字串
用len(a)得到的字串长度为1
原本应该是会得到<div class="unified-baseball-card" ..... </div>
这一段网页原始码, 想说可以用引号分割得到第六部分的网址
不知道各位大大是否有更好的方法可以解决小弟的问题呢?
谢谢!!
原始档如下:
# -*- coding: UTF-8 -*-
import requests
from bs4 import BeautifulSoup
res =
requests.get("
https://social.msdn.microsoft.com/Forums/zh-TW/389e90b5-b2d9-412b-a7eb-91cb9a68d108/vs2015-?forum=230")
soup = BeautifulSoup(res.text.encode('utf-8'))
a = soup.select('.unified-baseball-card')[0]
print a
b = a.split('"',6)
print b[5]
若用文字带入会得到
https://social.msdn.microsoft.com/Forums/zh-TW/user/threads?user=a670334
也就是我想要得到的解答QQ
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 167.220.232.152
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1470045819.A.DEF.html
1F:推 kenduest: a 不是 text, 那是一个 class 08/01 19:04
2F:→ kenduest: 若你真的要取这个 class 直接用内部显示名称的话 08/01 19:05
3F:→ kenduest: 救自己加上 a = str(...) 方式转一层就好 08/01 19:05
5F:→ NikonD800E: 感谢两位大师~ 是我学艺不精误认他为字串 08/02 09:29
6F:→ NikonD800E: 也感谢hoho8帮忙抓出soup里头的连结!! 08/02 09:32