【发布时间】:2016-12-19 20:44:56
【问题描述】:
我正在研究比较不同搜索平台在 Twitter 推文上的表现。出于我的目的,我收集了一组推文(大约 50,000 条)并将它们保存在单个文本 (.txt) 文件中,格式类似于以下:
Tweet ID User Tweet Content Tweet Time-stamp
数据如下所示:
31261817690923008 username1 tweet 1 content goes here 1482180069
31132193287839744 username2 tweet 2 content goes here 1274400000
现在,使用 Solr 6.3.0,是否可以单独索引每一行内容?相反,我应该使用 XML 还是 JSON?还是我必须将每一行(推文)存储在不同的文件中?
【问题讨论】: