【发布时间】:2022-01-10 13:29:28
【问题描述】:
我正在使用 mBART-50 和 Hugging Face 在印地语和英语之间进行翻译。但是加载库需要很多时间。有什么办法可以优化吗?
from transformers import MBartForConditionalGeneration, MBart50TokenizerFast
model= MBartForConditionalGeneration.from_pretrained("facebook/mbart-large-50-many-to-many-mmt")
tokenizer=MBart50TokenizerFast.from_pretrained("facebook/mbart-large-50-many-to-many-mmt",src_lang="hi_IN")
text="मैं ठीक हूँ।"
model_inputs=tokenizer(text,return_tensors="pt")
generated_tokens=model.generate(**model_inputs,forced_bos_token_id=tokenizer.lang_code_to_id["en_XX"])
translation=tokenizer.batch_decode(generated_tokens,skip_special_tokens=True)
print(translation)
【问题讨论】:
标签: python huggingface-transformers huggingface-tokenizers