【问题标题】:scraping imdb top 250 data and replicating in powerpoint using python使用 python 抓取 imdb 前 250 个数据并在 powerpoint 中复制
【发布时间】:2019-02-22 09:39:00
【问题描述】:

Windows 上的 Python27(32 位)

各位专家,

我指的是这个网站

我试图做同样的事情,但遇到了这个错误并卡住了。

import win32com.client
import os
import win32com.gen_py.MSO as MSO # contains constants refering to Microsoft Office Objects
import win32com.gen_py.MSPPT as MSPPT # contains constants refering to Microsoft Office Power Point Objects
from lxml.html import parse

tree = parse('http://www.imdb.com/chart/top')
movies = tree.findall('.//table[@class="chart full-width"]//td[@class="titleColumn"]//a')
movies[0].text_content()
  • IOError: Error reading file 'http://www.imdb.com/chart/top': failed to load external entity "http://www.imdb.com/chart/top"

有人可以帮忙吗?

【问题讨论】:

    标签: python web-scraping lxml


    【解决方案1】:

    http://www.imdb.com/chart/top 正在重定向到https://www.imdb.com/chart/top,lxml 不支持安全连接。

    查看answer

    【讨论】:

      猜你喜欢
      • 2022-10-21
      • 2013-11-05
      • 2022-01-07
      • 1970-01-01
      • 2022-08-22
      • 2011-06-03
      • 1970-01-01
      • 2011-10-23
      • 1970-01-01
      相关资源
      最近更新 更多