【发布时间】:2016-04-30 03:30:40
【问题描述】:
如何使用 apache tika 解析.Pst 文件
1.2?
使用 ljcene 搜索时如何获取电子邮件的整个正文、附件和所有元数据?
for (File file : docs.listFiles()) {
Metadata metadata = new Metadata();
ContentHandler handler = new BodyContentHandler();
ParseContext context = new ParseContext();
Parser parser = new AutoDetectParser();
InputStream stream = new FileInputStream(file);
try {
parser.parse(stream, handler, metadata, context);
}
catch (TikaException e) {
e.printStackTrace();
}
catch (SAXException e) {
e.printStackTrace();
}
【问题讨论】:
-
是的,我已经尝试使用带有 BodyContenthandle、元数据和文档对象的自动检测解析器
-
for (File file : docs.listFiles()) { Metadata metadata = new Metadata(); ContentHandler handler = new BodyContentHandler(); ParseContext 上下文 = 新 ParseContext(); Parser parser = new AutoDetectParser(); InputStream 流 = new FileInputStream(file);尝试 { parser.parse(流、处理程序、元数据、上下文); } catch (TikaException e) { e.printStackTrace(); } catch (SAXException e) { e.printStackTrace(); }
标签: pst