【发布时间】:2020-03-12 13:22:42
【问题描述】:
我一直在从事“尼泊尔语”的图像字幕项目。对于数据集部分,我尝试将所有英文字幕文本翻译成 Flickr8k 数据集的尼泊尔语。为此,我使用 python translate 工具作为
dataset = pd.read_csv('/content/gdrive/My Drive/out.csv',delimiter = '\t')
dataset.drop('Unnamed: 0',axis = 1)
def trans(x):
translator= Translator(to_lang="ne")
return translator.translate(x)
dataset['caption'] = dataset['caption'].apply(trans)
print('done')
但它只将 130 行字幕翻译成尼泊尔语,然后所有其他文本都被翻译为
我的记忆警告:您今天使用了所有可用的免费翻译。下一个可在 23 小时 24 分钟 38 秒内翻译更多内容
有什么方法可以一次性翻译所有的文本吗?
我也尝试过 googletrans,但由于频繁请求 API 也失败了
注意:该数据集包含 40458 行,标题栏中有英文句子。
如果有任何方法可以翻译所有文本,这将是很大的帮助,并在此先感谢 :)
【问题讨论】:
标签: python deep-learning nlp google-translate