【发布时间】:2018-03-06 21:05:48
【问题描述】:
我正在用 docx4j 做一些测试。我需要做的是将复杂的 Word 文档(2-3 页文本、表格、项目符号列表、图像)转换为 xhtml。
它工作正常,我只有 2 个问题:
-
覆盖一个 word 文档大约需要 30 秒。这一行占用了 95% 的计算时间:
wordMLPackage = Docx4J.load(new java.io.File(inputfilepath));
最终目标是创建一个简单的 webapp,它可以获取 Word 文档(每次都不同)并返回 xhtml。用户不能等待这么久。有什么可以提高性能的吗?为什么需要这么长时间(例如 Tika 的速度要快数百倍)?目前我在我的笔记本 Eclipse IDE 上运行它,反正速度很快,你认为一旦运行服务器端会更好吗?
非常感谢。
【问题讨论】:
-
请将此问题拆分为 2 个问题。我已经回答了第一个。
标签: java ms-word xhtml docx docx4j