Google为开发者推出改进后的语音转文本服务
2018-04-10 16:35
来源:
太平洋电脑网
几周前,Google 刚刚对“云端文本转语音”API 实施了大改版。现在,该公司又升级了自家的 Speech-to-Text 语音识别服务。改进后的 STT API 承诺显著提升了语音识别的性能,在内部所有测试中,单词错误率减少了 54% 左右。不过在某些领域,实际表现要好得多。基于用例,新版 API 现允许开发者在四种不同的机器学习模型间进行选择。
其中有面向短查询和语音命令的,以及一个理解通话语音和处理 视频 中音频的。第四个模型属于新增默认,谷歌推荐在所有其它场景中使用。
此外,谷歌还带来了一项新的标点符号模型。团队承认,其录音文本长期饱受标点符号不太正常的吐槽。用标点符号来表达自己的观点,算是出了名的困难。
谷歌承诺新模型可带来更多可读的转录文本,包括更少的断句、更多的逗号、句号、以及问号。
本次更新后,谷歌还允许开发者借助一些基本的元数据标记他们的转录音视频。尽管一时发挥不了直接的益处,但谷歌表示,它将使用来自所有用户的聚合信息,来决定下一步要优先考虑哪些新功能。
最后,谷歌还试图对这项服务的收费方式做出小小的改动。此前,音频转录的收费标准为 0.006 美元 / 每 15 秒;视频模型的收费翻倍(0.012 美元 / 每 15 秒)。
不过 5 月 31 号之后,使用新模型也需要支付 0.006 美元 / 每 15 秒。
声明:
本文由入驻维科号的作者撰写,观点仅代表作者本人,不代表OFweek立场。如有侵权或其他问题,请联系举报。
图片新闻
最新活动更多
-
11月28日立即报名>>> 2024工程师系列—工业电子技术在线会议
-
11月29日立即预约>> 【上海线下】设计,易如反掌—Creo 11发布巡展
-
11月30日立即试用>> 【有奖试用】爱德克IDEC-九大王牌安全产品
-
即日-12.5立即观看>> 松下新能源中国布局:锂一次电池新品介绍
-
12月19日立即报名>> 【线下会议】OFweek 2024(第九届)物联网产业大会
-
即日-12.26火热报名中>> OFweek2024中国智造CIO在线峰会
发表评论
请输入评论内容...
请输入评论/评论长度6~500个字
暂无评论
暂无评论