【问题标题】:Translating big amount of csv file (Flickr8k_text dataset) to 'Nepali' Language in python在 python 中将大量 csv 文件(Flickr8k_text 数据集)转换为“尼泊尔语”语言
【发布时间】:2020-03-12 13:22:42
【问题描述】:

我一直在从事“尼泊尔语”的图像字幕项目。对于数据集部分,我尝试将所有英文字幕文本翻译成 Flickr8k 数据集的尼泊尔语。为此,我使用 python translate 工具作为

dataset = pd.read_csv('/content/gdrive/My Drive/out.csv',delimiter = '\t')
dataset.drop('Unnamed: 0',axis = 1)
def trans(x):
    translator= Translator(to_lang="ne")
    return translator.translate(x)
dataset['caption'] = dataset['caption'].apply(trans)
print('done')

但它只将 130 行字幕翻译成尼泊尔语,然后所有其他文本都被翻译为

我的记忆警告:您今天使用了所有可用的免费翻译。下一个可在 23 小时 24 分钟 38 秒内翻译更多内容

有什么方法可以一次性翻译所有的文本吗?

我也尝试过 googletrans,但由于频繁请求 API 也失败了

注意:该数据集包含 40458 行,标题栏中有英文句子。

如果有任何方法可以翻译所有文本,这将是很大的帮助,并在此先感谢 :)

【问题讨论】:

    标签: python deep-learning nlp google-translate


    【解决方案1】:

    好的,我自己想出来的。使用 google sheet 并导入您的 csv 文件 并创建一个标题为目标语言名称的列,并使用公式=googletranslate(cell_with_text, "source_language", "target_language")

    示例:=googletranslate(A2,"en","ne") 现在从单元格的一角开始,鼠标指针显示为 + 号,然后一直向下,宾果游戏您可以一次翻译列中的所有文本。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2016-11-06
      • 2021-01-25
      • 2015-04-14
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多