【发布时间】:2019-02-18 05:13:58
【问题描述】:
我正在使用 Reddit API Praw 进行情绪分析。我的代码如下:
#!/usr/bin/env python
# -*- coding: utf-8 -*-
import praw
from IPython import display
from nltk.sentiment.vader import SentimentIntensityAnalyzer as SIA
from pprint import pprint
import pandas as pd
import nltk
import seaborn as sns
import datetime
sns.set(style='darkgrid', context='talk', palette='Dark2')
reddit = praw.Reddit(client_id='XXXXXXXXXXX',
client_secret='XXXXXXXXXXXXXXXXXXX',
user_agent='StackOverflow')
headlines = set()
results = []
sia = SIA()
for submission in reddit.subreddit('bitcoin').new(limit=None):
pol_score = sia.polarity_scores(submission.title)
pol_score['headline'] = submission.title
readable = datetime.datetime.fromtimestamp(submission.created_utc).isoformat()
results.append((submission.title, readable, pol_score["compound"]))
display.clear_output()
问题 A:使用此代码,我只能提取文本的标题以及其他几个键。我想以 JSON 格式提取所有内容,但研究我还没有看到的文档是否可行。
如果我在 reddit.subreddit('bitcoin') 中只调用 submission,结果只会显示 id 码。我想提取所有内容,任何信息并将其保存在 JSON 文件中。
问题 B:如何提取特定日期的 cmets/消息?
【问题讨论】:
标签: python python-3.x reddit praw