【发布时间】:2017-04-03 08:54:41
【问题描述】:
我在这个网站上进行了一些研究以找到解决我的问题的方法,但要么线程太旧(Yahoo 几年前刷新了它的页面),要么它们太复杂(我仍然 新刮)。 我想在此代码创建的 csv 文件中搜索关键字。
我使用了这段代码,但是雅虎的标题有点难以获得,让我解释一下。
# import libraries
import urllib2
from bs4 import BeautifulSoup
import csv
from datetime import datetime
quote_page = 'https://finance.yahoo.com/'
page = urllib2.urlopen(quote_page)
soup = BeautifulSoup(page, 'html.parser')
name_box = soup.find('h1', attrs={'class': 'name'})
name = name_box.text.strip()
print name
with open('index.csv', 'a') as csv_file:
writer = csv.writer(csv_file)
writer.writerow([name, ])
正如您在这张图片中看到的,标题介于以下之间: !-- 反应文本:3388 --> !-- /反应文本--> 但我不知道如何转换我的代码以便能够阅读这些。
解决方案可能很简单,但我尝试了很多方法,但似乎没有任何效果。
我希望您能帮助我或找到另一种在这些标题中查找关键字的方法。
提前非常感谢您。
【问题讨论】:
-
您是否尝试为 StretchedBox 上方的锚标记选择 innerText?
标签: python web-scraping yahoo-finance