【发布时间】:2023-01-19 12:44:22
【问题描述】:
现在我有:
model = GPTNeoForCausalLM.from_pretrained(model_name)
tokenizer = GPT2Tokenizer.from_pretrained(model_name)
input_ids = tokenizer(prompt, return_tensors="pt").input_ids.cuda()
gen_tokens = model.generate(input_ids, do_sample=specifiedDoSample, output_scores=True, temperature=specifiedTemperature, max_new_tokens=specifiedNumTokens, repetition_penalty=specifiedRepetitionPenalty, top_p=specifiedTopP)
gen_text = tokenizer.batch_decode(gen_tokens)[0]
print(gen_text)
这将打印生成的文本。但是,我希望它列出每个步骤中的前 N 个标记及其概率(N 是我指定的数字),类似于 OpenAI 的 beta 游乐场,您可以在其中选择“显示概率:全谱”。例如,如果提示是“你现在是一个”,下一个标记应该是类似{“vampire”: 51%, “corpse”: 32% ...等}
通过 Huggingface 变形金刚做到这一点的最简单方法是什么?
【问题讨论】:
标签: python nlp huggingface-transformers gpt-3