【发布时间】:2014-07-01 12:55:55
【问题描述】:
我有一些简单的代码来提取一些 JSON Twitter 数据,并将一些特定字段输出到 CSV 文件的单独列中。我的问题是,我一生都无法找出将输出编码为 UTF-8 的正确方法。下面是我能得到的最接近的结果,在这里的成员的帮助下,但由于推文文本字段中的唯一字符,我仍然无法正常运行并且失败。
import json
import sys
import csv
import codecs
def main():
writer = csv.writer(codecs.getwriter("utf-8")(sys.stdout), delimiter="\t")
for line in sys.stdin:
line = line.strip()
data = []
try:
data.append(json.loads(line))
except ValueError as detail:
continue
for tweet in data:
## deletes any rate limited data
if tweet.has_key('limit'):
pass
else:
writer.writerow([
tweet['id_str'],
tweet['user']['screen_name'],
tweet['text']
])
if __name__ == '__main__':
main()
【问题讨论】:
标签: python csv twitter encoding utf-8