【问题标题】:Getting max value from dictionary and corresponding values从字典和相应的值中获取最大值
【发布时间】:2020-07-06 00:33:23
【问题描述】:

我有一个使用 google STT 引擎的 python 脚本,然后它通过字典循环检查使用 difflib SequenceMatcher 的最大匹配(比率)在哪里

更新(更好地解释脚本需要做什么):

  1. 变量 izgovoreno 包含字符串(来自 google STT 引擎,实际上是麦克风) - 假设它的值为“lights”
  2. 有一个嵌套字典,其中每个热词(如“灯亮”、“百叶窗关闭”等)都包含相应的命令。有“热词”,也有“komanda”。在此示例中,启动指令值是“开灯”,对应的 komanda 是“执行一些代码来开灯”
  3. 只有在变量 izgovoreno 和启动指令之间存在一定百分比(至少 50% 或十进制 0.5)匹配时才会执行 komanda。 因此,有一个 for 循环通过字典并使用 difflib。SequenceMatcher 将变量 izgovoreno 与字典中的所有热门词进行比较,然后将结果(百分比)写入每个相应热门词的键“razlika_izgovoreno_hotword”。
  4. 现在我们有了包含这些数据的字典(示例):
hotword:"lights on"
komanda:"execute some code to turn on the lights"
razlika_izgovoreno_hotword:"0.90"
hotword:"blinds shut"
komanda:"execute some code shut blinds"
razlika_izgovoreno_hotword:"0.10"
etc.
  1. 在下一步中,我将使用 for 循环(这是在代码中分离出来的循环,这给我带来了麻烦)从字典中获取 razlika_izgovoreno_hotword 的最大值,并从键 hotword 和 komanda 中获取相应的值。但是,老实说,这个循环是香肠,我真的不明白它是如何工作的(我是 python 新手),但我能够获得 razlika_izgovoreno_hotword 和 komanda 值的最大值。 我只是无法获得启动指令值,这不是脚本运行所必需的,但很高兴将它用于调试。
  2. 本例中的预期结果(与变量 izgovoreno 相比最佳匹配)当然是热词“lights on”,匹配率为 0.9,然后执行 variable komanda = “execute some code to turn on the lights”。李>

完整的工作代码:

#!/usr/bin/env python3.6
# -*- coding: UTF-8 -*-
# NOTE: this example requires PyAudio because it uses the Microphone class

import snowboydecoder
import sys
import signal
import subprocess
import speech_recognition as sr
import urllib
import difflib

interrupted = False


def signal_handler(signal, frame):
    global interrupted
    interrupted = True


def interrupt_callback():
    global interrupted
    return interrupted

if len(sys.argv) == 1:
    print("Error: need to specify model name")
    print("Usage: python demo.py your.model")
    sys.exit(-1)

model = sys.argv[1]

# capture SIGINT signal, e.g., Ctrl+C
signal.signal(signal.SIGINT, signal_handler)

detector = snowboydecoder.HotwordDetector(model, sensitivity=0.5)
print('Snowboy listening... Press Ctrl+C to exit')

# main loop
def detektiran():
 snowboydecoder.play_audio_file()
 r = sr.Recognizer()
 with sr.Microphone() as source:
    print("Say something!")
    audio = r.listen(source,phrase_time_limit=5)
 # recognize speech using Google Speech Recognition
    try:
    # for testing purposes, we're just using the default API key
    # to use another API key, use `r.recognize_google(audio, key="GOOGLE_SPEECH_RECOGNITION_API_KEY")`
    # instead of `r.recognize_google(audio)`
         print("Izgovoreno: " + r.recognize_google(audio, language="hr-HR"))
     izgovoreno = r.recognize_google(audio, language="hr-HR")

        ##############KOMANDE - ubacivanje novih i promjena postojecih#################################################
     glasovne_naredbe = {
          ###svijetlo 1 prostorija
         'glasovno1' : {
          "hotword": "svijetlo",
          "komanda": "urllib.urlopen('http://127.0.0.1:8080/json.htm?type=command&param=switchlight&idx=2&switchcmd=On')"
         },
          ###zvuk najglasnije
         'glasovno2' : {
          "hotword": "najglasnije",
          "komanda": "subprocess.Popen(['amixer', 'set', 'Master', '100%'])"
         },
          ###zvuk najtiše
         'glasovno3' : {
          "hotword": "najtiše",
          "komanda": "subprocess.Popen(['amixer', 'set', 'Master', '10%'])"
         },
          ###zvuk srednje glasno
         'glasovno4' : {
          "hotword": "srednje glasno",
          "komanda": "subprocess.Popen(['amixer', 'set', 'Master', '50%'])"
         },
          ###zvuk smanji
         'glasovno5' : {
          "hotword": "smanji",
          "komanda": "subprocess.Popen(['amixer', 'set', 'Master', '10%-'])"
         },
          ###zvuk pojačaj
         'glasovno6' : {
          "hotword": "pojačaj",
          "komanda": "subprocess.Popen(['amixer', 'set', 'Master', '10%+'])"
         }
      }



          ###############KOMANDE KRAJ##########################################################################
     i = 0
     for a, b in glasovne_naredbe.items():
        #print(a, b)
        i += 1
        glasovno = ("glasovno" + str(i)) 
        hotword = (glasovne_naredbe[glasovno]['hotword'])
            hotword_decoded = hotword.decode('utf-8')
            razlika_izgovoreno_hotword = difflib.SequenceMatcher(None, izgovoreno, hotword_decoded).ratio() #svaka razlika iznad 0.50 aktivira komandu  
            #print ("Omjer(%s) Izgovoreno (%s) Hotword (%s)" % (razlika_izgovoreno_hotword, izgovoreno, hotword_decoded))
        #ubacivanje (privremenog) rezultata razlika_izgovoreno_hotword u dictionary
        glasovne_naredbe[glasovno]['razlika_izgovoreno_hotword'] = razlika_izgovoreno_hotword
     #izvlacenje maksimalnog razlika_izgovoreno_hotword iz dictionarya  
     razlika_izgovoreno_key, razlika_izgovoreno_value, komanda_value, komanda_key = \
     max(((raz_k,raz_v,k_k,k_v)  for inner_d in glasovne_naredbe.values() for raz_k,raz_v in inner_d.items() for k_v,k_k in inner_d.items()))
     print("Vrijednost razlika_izgovoreno postotak: %s" % (razlika_izgovoreno_value))
     print("Komanda: %s" % (komanda_value)) 
     if razlika_izgovoreno_value >= 0.50: #ako je ratio u postotku veci od 0.50, pokreni komandu
        exec(komanda_value)
        #dong zvuk da je uspjesno izvedeno
     else:
        print ("Izgovoreno se ne podudara minimalno 50% sa nijednim hotwordom, molim ponovi!")

    except sr.UnknownValueError:
        print("Google Speech Recognition could not understand audio")
    except sr.RequestError as e:
        print("Could not request results from Google Speech Recognition service; {0}".format(e))

detector.start(detected_callback=detektiran,
               interrupt_check=interrupt_callback,
               sleep_time=0.03)

detector.terminate()

我对这部分代码有疑问,我可以在其中获得“razlika_izgovoreno_value”的最大值,并且可以获得相应的“komanda_value”,但无法获得“hotword_value”的相应值。

razlika_izgovoreno_key, razlika_izgovoreno_value, komanda_value, komanda_key, hotword_key, hotword_value = \
     max(((raz_k,raz_v,k_k,k_v,h_v,h_k)  for inner_d in glasovne_naredbe.values() for raz_k,raz_v in inner_d.items() for k_v,k_k in inner_d.items() for h_v,h_k in inner_d.items()))

有什么建议吗?我已经尝试了 for 循环中的所有组合,但我就是无法获得启动指令值。

编辑: glasovne_naredbe 的输出(比较的测试词是“test”)

Izgovoreno: test
{'glasovno1': 
    {'komanda': "urllib.urlopen('http://127.0.0.1:8080/json.htm?    type=command&param=switchlight&idx=2&switchcmd=On')", 
    'hotword': 'svijetlo', 
    'razlika_izgovoreno_hotword': 0.16666666666666666}, 
'glasovno2':
     {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '100%'])", 
    'hotword': 'najglasnije',
     'razlika_izgovoreno_hotword': 0.13333333333333333},
 'glasovno3': 
    {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%'])",
     'hotword': 'najti\xc5\xa1e',
     'razlika_izgovoreno_hotword': 0.36363636363636365},
 'glasovno4': 
    {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '50%'])", 
    'hotword': 'srednje glasno',
     'razlika_izgovoreno_hotword': 0.2222222222222222},
 'glasovno5':
     {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%-'])",
     'hotword': 'smanji',
     'razlika_izgovoreno_hotword': 0.2},
 'glasovno6': 
    {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%+'])", 
    'hotword': 'poja\xc4\x8daj',
     'razlika_izgovoreno_hotword': 0.0}

【问题讨论】:

  • 忠告:可以直接运行的post代码。 2. 准确说明你想要做什么。将其分解为 inner_d ... 为一堆步骤。添加 cmets 解释每个步骤。打印中间输出,看看出了什么问题。你认为 max() 在做什么?你认为每一步传递给 max() 的值是什么?
  • 无法完全理解该语言。保加利亚语?塞尔维亚?我很好奇,如果可以的话
  • @poleguy 谢谢你的建议——我会尽量让这件事变得简单。 CaptainChaos 是克罗地亚语(99% 与塞尔维亚语相同)
  • 请包含 print(glasovne_naredbe) 的输出。就在中断的 for 循环之前。
  • @poleguy 好的,已添加。

标签: python dictionary max


【解决方案1】:

我会先将那段冗长的“for”语句重新格式化成这样的:

for inner_d in glasovne_naredbe.values():
    print(inner_d)
    ...

这将使您(和其他人)更容易理解您的代码,并得出答案。

还要确保 max() 正在执行您认为的操作。

这不是一个明确的问题,所以我猜这可能会有所帮助。这是一个完全运行的 python 解决方案,显示了我认为您的问题所要求的解决方案:

glasovne_naredbe = {'glasovno1': 
    {'komanda': "urllib.urlopen('http://127.0.0.1:8080/json.htm?    type=command&param=switchlight&idx=2&switchcmd=On')", 
    'hotword': 'svijetlo', 
    'razlika_izgovoreno_hotword': 0.16666666666666666}, 
'glasovno2':
     {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '100%'])", 
    'hotword': 'najglasnije',
     'razlika_izgovoreno_hotword': 0.13333333333333333},
 'glasovno3': 
    {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%'])",
     'hotword': 'najti\xc5\xa1e',
     'razlika_izgovoreno_hotword': 0.36363636363636365},
 'glasovno4': 
    {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '50%'])", 
    'hotword': 'srednje glasno',
     'razlika_izgovoreno_hotword': 0.2222222222222222},
 'glasovno5':
     {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%-'])",
     'hotword': 'smanji',
     'razlika_izgovoreno_hotword': 0.2},
 'glasovno6': 
    {'komanda': "subprocess.Popen(['amixer', 'set', 'Master', '10%+'])", 
    'hotword': 'poja\xc4\x8daj',
     'razlika_izgovoreno_hotword': 0.0}}

max_key,value = next(iter(glasovne_naredbe.items()))
max_value = value['razlika_izgovoreno_hotword']
for key, value in glasovne_naredbe.items():
    print(key)
    print(value)
    new_value = value['razlika_izgovoreno_hotword']
    if new_value > max_value:
        print("new max")
        print(key)
        max_value = new_value
        max_key = key
print("max key %s" % max_key)
print("corresponding komanda %s" % glasovne_naredbe[max_key]['komanda'])
print("corresponding hotword %s" % glasovne_naredbe[max_key]['hotword'])
print("corresponding r_i_h %s" % glasovne_naredbe[max_key]['razlika_izgovoreno_hotword'])

参考资料:

Getting key with maximum value in dictionary?

How do I print the key-value pairs of a dictionary in python

How do you find the first key in a dictionary?

【讨论】:

  • 我添加了对代码需要做什么的更好解释。我已经测试了这段代码,但它总是返回“glasovno1”值,它似乎看不出哪个热词在键“razlika_izgovoreno_hotword”上具有最大值。我不确定你是否不明白我需要什么或那里是一些错误。无论如何,谢谢!
  • 我现在想,我的示例答案是您的问题应该是什么样子:完全可执行的代码,顶部完全定义了数据。如果不是现在,也许我仍然想念你的意图,或者我对你的数据看起来不正确的猜测。
猜你喜欢
  • 1970-01-01
  • 2013-11-15
  • 2021-02-12
  • 2021-07-30
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2020-02-02
  • 2016-02-24
相关资源
最近更新 更多