from newspaper import Article

url = '你想要爬取的网站url' news = Article(url, language='zh')
news .download() #先下载 news .parse() #再解析
print(news.text) #新闻正文 print(news.title) #新闻标题 print(news.html) #未修改的原始HTML print(news.authors) #新闻作者 print(news.keywords) #新闻关键词
print(news.images) #本文中的所有图像url
print(news.imgs) #本文中的所有图像url

相关文章:

  • 2021-09-15
  • 2022-01-16
  • 2022-12-23
  • 2022-12-23
  • 2022-12-23
  • 2021-12-29
  • 2021-12-23
  • 2021-10-26
猜你喜欢
  • 2021-04-08
  • 2021-12-10
  • 2021-04-11
  • 2022-12-23
  • 2022-12-23
  • 2021-04-24
  • 2021-10-06
相关资源
相似解决方案