【发布时间】:2020-07-06 00:33:23
【问题描述】:
我有一个使用 google STT 引擎的 python 脚本,然后它通过字典循环检查使用 difflib SequenceMatcher 的最大匹配(比率)在哪里
更新(更好地解释脚本需要做什么):
- 变量 izgovoreno 包含字符串(来自 google STT 引擎,实际上是麦克风) - 假设它的值为“lights”
- 有一个嵌套字典,其中每个热词(如“灯亮”、“百叶窗关闭”等)都包含相应的命令。有“热词”,也有“komanda”。在此示例中,启动指令值是“开灯”,对应的 komanda 是“执行一些代码来开灯”
- 只有在变量 izgovoreno 和启动指令之间存在一定百分比(至少 50% 或十进制 0.5)匹配时才会执行 komanda。 因此,有一个 for 循环通过字典并使用 difflib。SequenceMatcher 将变量 izgovoreno 与字典中的所有热门词进行比较,然后将结果(百分比)写入每个相应热门词的键“razlika_izgovoreno_hotword”。
- 现在我们有了包含这些数据的字典(示例):
hotword:"lights on" komanda:"execute some code to turn on the lights" razlika_izgovoreno_hotword:"0.90" hotword:"blinds shut" komanda:"execute some code shut blinds" razlika_izgovoreno_hotword:"0.10" etc.
- 在下一步中,我将使用 for 循环(这是在代码中分离出来的循环,这给我带来了麻烦)从字典中获取 razlika_izgovoreno_hotword 的最大值,并从键 hotword 和 komanda 中获取相应的值。但是,老实说,这个循环是香肠,我真的不明白它是如何工作的(我是 python 新手),但我能够获得 razlika_izgovoreno_hotword 和 komanda 值的最大值。 我只是无法获得启动指令值,这不是脚本运行所必需的,但很高兴将它用于调试。
- 本例中的预期结果(与变量 izgovoreno 相比最佳匹配)当然是热词“lights on”,匹配率为 0.9,然后执行 variable komanda = “execute some code to turn on the lights”。李>
完整的工作代码:
#!/usr/bin/env python3.6
# -*- coding: UTF-8 -*-
# NOTE: this example requires PyAudio because it uses the Microphone class
import snowboydecoder
import sys
import signal
import subprocess
import speech_recognition as sr
import urllib
import difflib
interrupted = False
def signal_handler(signal, frame):
global interrupted
interrupted = True
def interrupt_callback():
global interrupted
return interrupted
if len(sys.argv) == 1:
print("Error: need to specify model name")
print("Usage: python demo.py your.model")
sys.exit(-1)
model = sys.argv[1]
# capture SIGINT signal, e.g., Ctrl+C
signal.signal(signal.SIGINT, signal_handler)
detector = snowboydecoder.HotwordDetector(model, sensitivity=0.5)
print('Snowboy listening... Press Ctrl+C to exit')
# main loop
def detektiran():
snowboydecoder.play_audio_file()
r = sr.Recognizer()
with sr.Microphone() as source:
print("Say something!")
audio = r.listen(source,phrase_time_limit=5)
# recognize speech using Google Speech Recognition
try:
# for testing purposes, we're just using the default API key
# to use another API key, use `r.recognize_google(audio, key="GOOGLE_SPEECH_RECOGNITION_API_KEY")`
# instead of `r.recognize_google(audio)`
print("Izgovoreno: " + r.recognize_google(audio, language="hr-HR"))
izgovoreno = r.recognize_google(audio, language="hr-HR")
##############KOMANDE - ubacivanje novih i promjena postojecih#################################################
glasovne_naredbe = {
###svijetlo 1 prostorija
'glasovno1' : {
"hotword": "svijetlo",
"komanda": "urllib.urlopen('http://127.0.0.1:8080/json.htm?type=command¶m=switchlight&idx=2&switchcmd=On')"
},
###zvuk najglasnije
'glasovno2' : {
"hotword": "najglasnije",
"komanda": "subprocess.Popen(['amixer', 'set', 'Master', '100%'])"
},
###zvuk najtiše
'glasovno3' : {
"hotword": "najtiše",
"komanda": "subprocess.Popen(['amixer', 'set', 'Master', '10%'])"
},
###zvuk srednje glasno
'glasovno4' : {
"hotword": "srednje glasno",
"komanda": "subprocess.Popen(['amixer', 'set', 'Master', '50%'])"
},
###zvuk smanji
'glasovno5' : {
"hotword": "smanji",
"komanda": "subprocess.Popen(['amixer', 'set', 'Master', '10%-'])"
},
###zvuk pojačaj
'glasovno6' : {
"hotword": "pojačaj",
"komanda": "subprocess.Popen(['amixer', 'set', 'Master', '10%+'])"
}
}
###############KOMANDE KRAJ##########################################################################
i = 0
for a, b in glasovne_naredbe.items():
#print(a, b)
i += 1
glasovno = ("glasovno" + str(i))
hotword = (glasovne_naredbe[glasovno]['hotword'])
hotword_decoded = hotword.decode('utf-8')
razlika_izgovoreno_hotword = difflib.SequenceMatcher(None, izgovoreno, hotword_decoded).ratio() #svaka razlika iznad 0.50 aktivira komandu
#print ("Omjer(%s) Izgovoreno (%s) Hotword (%s)" % (razlika_izgovoreno_hotword, izgovoreno, hotword_decoded))
#ubacivanje (privremenog) rezultata razlika_izgovoreno_hotword u dictionary
glasovne_naredbe[glasovno]['razlika_izgovoreno_hotword'] = razlika_izgovoreno_hotword
#izvlacenje maksimalnog razlika_izgovoreno_hotword iz dictionarya
razlika_izgovoreno_key, razlika_izgovoreno_value, komanda_value, komanda_key = \
max(((raz_k,raz_v,k_k,k_v) for inner_d in glasovne_naredbe.values() for raz_k,raz_v in inner_d.items() for k_v,k_k in inner_d.items()))
print("Vrijednost razlika_izgovoreno postotak: %s" % (razlika_izgovoreno_value))
print("Komanda: %s" % (komanda_value))
if razlika_izgovoreno_value >= 0.50: #ako je ratio u postotku veci od 0.50, pokreni komandu
exec(komanda_value)
#dong zvuk da je uspjesno izvedeno
else:
print ("Izgovoreno se ne podudara minimalno 50% sa nijednim hotwordom, molim ponovi!")
except sr.UnknownValueError:
print("Google Speech Recognition could not understand audio")
except sr.RequestError as e:
print("Could not request results from Google Speech Recognition service; {0}".format(e))
detector.start(detected_callback=detektiran,
interrupt_check=interrupt_callback,
sleep_time=0.03)
detector.terminate()
我对这部分代码有疑问,我可以在其中获得“razlika_izgovoreno_value”的最大值,并且可以获得相应的“komanda_value”,但无法获得“hotword_value”的相应值。
razlika_izgovoreno_key, razlika_izgovoreno_value, komanda_value, komanda_key, hotword_key, hotword_value = \
max(((raz_k,raz_v,k_k,k_v,h_v,h_k) for inner_d in glasovne_naredbe.values() for raz_k,raz_v in inner_d.items() for k_v,k_k in inner_d.items() for h_v,h_k in inner_d.items()))
有什么建议吗?我已经尝试了 for 循环中的所有组合,但我就是无法获得启动指令值。
编辑: glasovne_naredbe 的输出(比较的测试词是“test”)
Izgovoreno: test
{'glasovno1':
{'komanda': "urllib.urlopen('http://127.0.0.1:8080/json.htm? type=command¶m=switchlight&idx=2&switchcmd=On')",
'hotword': 'svijetlo',
'razlika_izgovoreno_hotword': 0.16666666666666666},
'glasovno2':
{'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '100%'])",
'hotword': 'najglasnije',
'razlika_izgovoreno_hotword': 0.13333333333333333},
'glasovno3':
{'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%'])",
'hotword': 'najti\xc5\xa1e',
'razlika_izgovoreno_hotword': 0.36363636363636365},
'glasovno4':
{'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '50%'])",
'hotword': 'srednje glasno',
'razlika_izgovoreno_hotword': 0.2222222222222222},
'glasovno5':
{'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%-'])",
'hotword': 'smanji',
'razlika_izgovoreno_hotword': 0.2},
'glasovno6':
{'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%+'])",
'hotword': 'poja\xc4\x8daj',
'razlika_izgovoreno_hotword': 0.0}
【问题讨论】:
-
忠告:可以直接运行的post代码。 2. 准确说明你想要做什么。将其分解为 inner_d ... 为一堆步骤。添加 cmets 解释每个步骤。打印中间输出,看看出了什么问题。你认为 max() 在做什么?你认为每一步传递给 max() 的值是什么?
-
无法完全理解该语言。保加利亚语?塞尔维亚?我很好奇,如果可以的话
-
@poleguy 谢谢你的建议——我会尽量让这件事变得简单。 CaptainChaos 是克罗地亚语(99% 与塞尔维亚语相同)
-
请包含 print(glasovne_naredbe) 的输出。就在中断的 for 循环之前。
-
@poleguy 好的,已添加。
标签: python dictionary max