【发布时间】:2023-03-31 19:09:01
【问题描述】:
我的处境很糟糕。我需要编程,这超出了我的能力范围。
我收到了一个 10k 字的文本,文件名为 (test_file.txt)。 我对你们的问题是: 如何让我的程序计算每个单词和每个字母,这样我就可以计算单词的概率,看看哪些单词和字母代表最多。
我知道这是字符串的东西,我现在所做的就是:
import codecs
import sys
import random
fh = codecs.open("test_file.txt", encoding="utf-8")
fh.close()
omega = {'a','b','c','d','e','f','g','h','i','j','k','l','m','n','o','p','q','r','s','t','u','v','w','x','y','z','A','B','C','D','E','F','G','H','I','J','K','L','M','N','O','P','Q','R','S','T','U','V','W','X','Y','Z'}
def Markov(text_file):
with open("test_file.txt") as t:
text = t.read()
text = [' '.join(data.split(' ')) if i !='']
text = [i.lower() for i in data if i.isalpha()]
chains = {i:[] for i in data}
这对吗?
我需要你们的帮助。
【问题讨论】:
-
当你用一个 20 字的小文件来测试它时,它是否如你所愿?
-
我什至不知道如何用小文件测试它,这就是问题所在。希望你能帮助我。
-
您将做一些超出您想象的事情称为“糟糕的情况”。我称之为“学习”。
-
我之所以称之为“糟糕的情况”,是因为我已经无法走得更远了。我知道该怎么做,我理解任务和意义,但我就是不会编码。
-
如果你不会编码,说明你真的不知道该怎么做。
标签: python string count probability markov-chains