【发布时间】:2011-05-29 12:05:29
【问题描述】:
TextGrid 是 Praat 程序使用的“分段”文件。我想编写一个解析器,然后验证数据。我的问题是:
您将如何为这种格式编写解析器?逐行阅读还是别的什么?这是一种已知格式吗?
File type = "ooTextFile"
Object class = "TextGrid"
xmin = 0
xmax = 93.0538775510204
tiers? <exists>
size = 3
item []:
item [1]:
class = "IntervalTier"
name = "diph"
xmin = 0
xmax = 93.0538775510204
intervals: size = 65
intervals [1]:
xmin = 0
xmax = 1.300090702947846
text = ""
intervals [2]:
xmin = 1.300090702947846
xmax = 1.5300845864661654
text = "ey_s"
intervals [3]:
xmin = 1.5300845864661654
xmax = 3.4648692624493815
text = ""
(然后重复到 EOF,间隔 [4....n])
【问题讨论】:
-
我会用整个 JSON 规范打击该格式的作者。不幸的是,规范只有一页。
-
@marw 我不知道格式,但它看起来很自定义。你能给我们举个例子来说明反斜杠、引号和换行符是如何存储的吗?如果是这样,编写解析器非常简单。
-
好吧,谷歌找到了我 :) NLTK 中存在解析器:nltk.googlecode.com/svn/trunk/nltk_contrib/nltk_contrib/… 感谢您的 cmets!如果上述失败,我会重新打开它。
-
@marw 实际上,将您的答案作为真实答案添加到您的问题(以及这些 cmets)下方,而不是作为问题的一部分。 :-)
-
我试过了,但我没有 100 分,我必须等待 8 小时才能回答我自己的问题。 :) 我稍后会改变它。