【发布时间】:2022-01-10 17:20:44
【问题描述】:
我正在使用这个线程来获得一些想法并找到一些可能性。
我有大约 1000 篇讲道及其翻译成另一种语言。讲道的长度是不同的。这些是宗教布道文本。由于领域(宗教),有很多词可以根据上下文以不同的方式使用。同一个词可以变成不同的意思。
有没有办法让我“以编程方式”获得目标语言中给定单词的翻译?
x1 -> [y2,z2,a2,b2,c2]
其中 x 是语言 1 中的单词
并且返回的数组包含语言 2 的翻译
这将是最好的情况。也许这可以通过使用领域数据训练翻译模型来实现,但我没有很多数据。
是否可以使用 word2vec?通过创建两个文本(语言 1 和语言 2)的向量空间并使用转换矩阵,是否可以将语义含义放在一起?
你知道其他方法或有其他想法吗?可能已经有这样的作品了吗?这类研究叫什么?我找不到这样的东西。我希望你们对如何实现这一点有一些想法。
一般目的是为该特定领域的研究人员“创建一个工具”,可用于分析讲道的翻译质量。如果您对如何分析翻译质量(语义)有其他想法,我将非常感谢。
【问题讨论】:
标签: machine-learning text-mining word2vec language-translation machine-translation