在Android上使用自定义不常用的单词匹配语音到文本

Bun*_*num 5 java android soundex metaphone speech-to-text

我希望能够使用Android的Speech-To-Text引擎识别句子中的各种不寻常的单词.

举一个例子,"脑电图"这个词来自STT,称为"电子供应图".当我使用Soundex或Metaphone将所说的内容与硬编码值进行比较时,该值似乎永远不会匹配或随机匹配.如果我使用阈值(Math.abs(str1.compareTo(str2))<= 1,那么匹配变得非常松散,几乎任何东西都匹配.

从本质上讲,我想做的是类似于通过背诵报价从报价数据库中查找报价.谷歌的语音转文本引擎使用的有限字集似乎更多的问题.

有任何想法吗?

Kaa*_*rel 3

您可以尝试使用或不使用基于语法的语音识别的CMUSphinx 。

看看Inimesed应用程序。这是一个开源 Android 应用程序,它使用 CMUSphinx 进行基于 JSGF 的语音识别。在这种情况下,语法是根据用户的地址簿编译的。您可以简单地扔掉这部分并拥有包含所有短语的固定语法。

如果问题更多的是您的自由格式句子偶尔包含不寻常的单词,那么基于语法的语音识别可能不起作用。在这种情况下,使用 n-gram 语言模型进行识别,但包括字典中的所有不常见单词。