【发布时间】:2014-11-02 20:56:49
【问题描述】:
我是编程新手。我正在尝试我的第一个 Web Crawler 程序,它将帮助我完成我的工作。我正在尝试构建一个程序,该程序将从网页中抓取 tr/td 表数据,但难以成功。这是我目前所拥有的:
import requests
from bs4 import BeautifulSoup
def start(url):
source_code = requests.get(url).text
soup = BeautifulSoup(source_code)
for table_data in soup.find_all('td', {'class': 'sorting_1'}):
print(table_data)
start('http://www.datatables.net/')
我的目标是打印出每一行,然后将其导出到 excel 文件中。
谢谢你, -Cire
【问题讨论】:
-
这不是一个糟糕的开始,哪个部分不起作用?
-
我似乎无法从此脚本中获取任何数据。它只是说“进程以退出代码0完成”。
标签: python beautifulsoup python-requests