
我想为三年级婴儿制作一个语音记忆应用程序. 场景非常简单: 该应用程序通过tts读取中英文单词,并使用stt比较婴儿所说的字母与原始单词是否一致. 整个声音已经完成,无需看手机并保护视力-为什么不是所有智能扬声器都使用这种杀手级应用程序完成?

我尝试了以下工具和库:

app: “请背单词星期一,Monday ”
娃: “ M O N D A Y ”
app: “您说的是 MNDEY,请重试”
娃: “...”

正确率(iOS)仅约为60%至70%. 这是每个字母的正确听写率. 连在一起的几个字母可以否认它基本上是一张脸. -请注意,为了使用经验,这里的“ MOND AY”必须是一个整体. 如果您添加按钮并单击以识别字母听写单词的app,则可以将准确性提高到99%以上-但是还有其他人想要使用该应用程序吗?

坦率地说听写单词的app,iOS的近场语音识别仍然面向整个句子的正常对话和逻辑建模. 背单词显然是不合适的. 但是,我发现了各种听写用法的集合,可以通过各种预定义的注释来实现. 特殊输入,苹果并不容易...
我目前能想到的唯一解决方案. 这个伙伴做了类似的事情,就是列出常用的1500个单词,让婴儿从头到尾拼写它,我记录并手动标记它,用TF来调整训练,然后导入CoreML,听起来看起来很爱,但仅适用于一个婴儿...
-我想献给那些认为AI即将统治世界的人们
本文来自电脑杂谈,转载请注明本文网址:
http://www.pc-fly.com/a/ruanjian/article-259799-1.html
还有那故意让老鼠咬破包长蛆的学生