代码之家  ›  专栏  ›  技术社区  ›  Jean-Philippe Encausse

Windows语音识别中的模糊仿真识别

  •  1
  • Jean-Philippe Encausse  · 技术社区  · 13 年前

    Microsoft C#API提供了一个SpeechRecognitionEngine来识别音频流。测试重新编码的一种方法是调用方法 语音识别器。模拟识别

    根据文件:

    recognizers ignore case and character width when applying 
    grammar rules to the input phrase
    

    我想知道是否有办法处理更多 模糊的 字符串,因为即使是拼写错误的文本,置信度也很低!远离现实生活。。。

    • 有了音频,我可以满怀信心地说你好,你好,你好
    • 对于Text,引擎非常严格

    编辑:为了什么目的?

    我的语音引擎工作正常,但我也想通过文本输入触发它。

    比方说你在手机上,使用HTML5语音识别。我想将识别的文本发送到引擎,以获得与语音相同的行为

    3 回复  |  直到 13 年前
        1
  •  1
  •   Jean-Philippe Encausse    13 年前

    好的,我找到了答案! 我应该更好地阅读文档!

    SpeechRecognizer.EmulateRecognize
    

    真的很简单,可以测试给定的字符串,但是

    SpeechRecognizer.SimulateRecognize
    

    将尝试建立输入短语的理想化音频表示(基于引擎的词典和声学模型)

    所以它非常有效!

        2
  •  0
  •   Eric Brown    13 年前

    当您将音频发送到识别器时,SR引擎会做大量工作来创建一组音素(通过声学建模),然后创建一组字符串(通过音素建模)。在这个过程中,大部分歧义都被消除了。 EmulateRecognize 不生成通过SR引擎处理的音频;它跳过所有建模,只进行字符串匹配。

    如果不涉及大量工作(例如,实现与SAPI兼容的SR引擎 只有 模拟识别 ).

        3
  •  0
  •   user2746020    13 年前

    在SpeechSynthesizer.Speak()中输入您的字符串,并将其用作SpeechRecognitionEngine的输入?