【问题标题】:Preparing XML data for Apriori algorithm为 Apriori 算法准备 XML 数据
【发布时间】:2015-01-18 14:41:48
【问题描述】:

Apriori算法一般以矩阵形式接收输入,如下:

TID A B C D E
T1 1 1 1 0 0
T2 1 1 1 1 1
T3 1 0 1 1 0
T4 1 0 1 1 1
T5 1 1 1 1 0 

虽然,我的输入是一般形式的 XML 数据:

 <article key="tr/gte/TR-0263-08-94-165">
<author>Frank Manola</author>
<title>An Evaluation of Object-Oriented DBMS Developments: 1994 Edition.</title>
<journal>GTE Laboratories Incorporated</journal>
<volume>TR-0263-08-94-165</volume>
<month>August</month>
<year>1994</year>
</article>

如何将此类数据转换为算法可接受的合适形式?任何建议。

谢谢

【问题讨论】:

    标签: xml algorithm mapping apriori


    【解决方案1】:

    假设您使用的是 Python,最好使用 Element Tree XML 解析器(文档包含在下面)。这允许您将 XML 数据解析为 Python 字典,然后您可以根据需要进行翻译。请注意,如果您的 XML 数据文件非常大,使用 iterparse 可以很方便地避免大量内存需求。

    https://docs.python.org/2/library/xml.etree.elementtree.html

    【讨论】:

    猜你喜欢
    • 2019-05-24
    • 2011-11-08
    • 1970-01-01
    • 2015-03-10
    • 1970-01-01
    • 2012-04-03
    • 2015-08-11
    • 1970-01-01
    • 2013-05-08
    相关资源
    最近更新 更多