【问题标题】:Using Apache Nifi to extract HL7 values and apply regex使用 Apache Nifi 提取 HL7 值并应用正则表达式
【发布时间】:2016-05-25 01:05:48
【问题描述】:

我需要使用 Apache Nifi 从 HL7 XML 文档中提取患者信息, 并应用正则表达式从包含嵌入式 HTML 的部分中提取诊断结果(是的,对不起。不是我的设计选择:-()

HL7 中感兴趣的数据的第一个路径是:

“临床文档”\“记录目标”\“患者角色”\“患者”\“姓名”,

第二个,更复杂的是:

"ClinicalDocument"\"structuredBody"\"component"\"section"\"text @mediaType="text/x-hl7-text+xml""其中的值title 元素等于“诊断结果”

我需要匹配 component 中 section 的 title 的子节点文本值的文本,其值为“Diagnostic Results”(诊断结果),然后提取对等节点的文本值text。

我的 HL7 XML sn-ps 看起来像:

</ClinicalDocument>
...
        <recordTarget>
            <patientRole>
....
            <patient>
                <name><given>John</given><family>Doe</family></name>
...
<structuredBody>
...
<component>
    <section classCode="DOCSECT" moodCode="EVN">
        <templateId root="0.0.0.0.0.0.1" />
        <code code="000-01" codeSystem="0.0.0.1.0.0"  />
        <title>Diagnostic Results</title>
        <text mediaType="text/x-hl7-text+xml">
            Some data of interest expressed in n microns.<content ID="NKN_results"/>
        </text>

关于如何在 Apache Nifi 中执行此操作的任何建议?

【问题讨论】:

    标签: regex hl7-v3 apache-nifi


    【解决方案1】:

    您应该能够使用 XPath 和 NiFi EvaluateXPath 处理器来匹配和提取 &lt;text&gt; 元素。我从结构化主体标签作为以下表达式的根开始:

    /structuredBody/component/section[title = 'Diagnostic Results' and text[@mediaType='text/x-hl7-text+xml']]/text
    

    但是您应该能够将其调整为完整的 XML 路径。一旦 &lt;text&gt; 元素被解析出来,从 NiFi 0.5.0 开始,您可以使用 GetHtmlElement 处理器从嵌入的 HTML 中提取。在 NiFi 0.5.0 之前,如果 HTML 格式正确(例如 XHTML),您可以使用另一个 EvaluateXPath 处理器。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2023-03-15
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2013-01-04
      相关资源
      最近更新 更多