【发布时间】:2011-10-12 21:39:32
【问题描述】:
我有以下问题:我有非常大的 XML 文件(如 300+ Megs),我需要解析它们以便将它们的一些值添加到 db。这些文件的结构也很复杂。我想使用 Stax Parser,因为它提供了一次拉解析(并因此处理)XML 文件的一部分的很好的可能性,因此不会将整个内容加载到内存中,而是另一方面获取值Stax(至少在这些 XML 文件上)很麻烦,我需要编写大量代码。从后一种角度来看,如果我可以将 XML 文件编组为 Java 对象(就像 JAX-B 一样),它将极大地帮助我,但这会同时加载整个文件以及内存中的大量 Object 实例。
我的问题是,是否有某种方法可以按顺序提取解析(或仅部分解析)文件,然后仅将这些部分编组为 Java 对象,以便我可以轻松处理它们而不会占用内存?
【问题讨论】: