智能手机的超性能语音识别技术

分享到:

       当语音识别技术应用到计算机桌面的时候,这看起来似乎是一个好主意。但是,对于大多数人来说,语音识别还不能取代键盘和鼠标。现在,语音技术正用于一个全新的环境:手机。语音识别技术在手机中的应用将进一步推动这种技术向新的方向发展和应用。这是语音识别技术在台式电脑应用中从来没有涉足的方向。

  IBM今年将纪念其创建100周年。IBM在60年代初期创建了一个名为“Shoebox”的试验性的语音识别系统。这个系统解决了口语算法问题。语音识别技术是在50年代作为一项早期的技术第一次出现的,当时主要是由于好奇。在60年代初,IBM的“Shoebox”设备能够识别出16个口语单词并且能够回答简单的数学问题,如“3 + 4 =?”。

  Dragon Systems在80年代初为DOS计算机推出的DragonDictate可能是第一个语音识别应用程序。这个应用程序只能识别单个单词,每次只说一个单词。随着时间的推移,这个应用程序已经发展成为名为“Dragon NaturallySpeaking”(目前是第11个版本,由Nuance通讯公司所有)的产品。这个应用程序能够翻译以正常的会话语音和速度读出的文本。

  语音识别技术在台式电脑中的应用有两个制约因素。第一,为了使这个应用程序以更高的准确性工作,这个应用程序必须要进行训练以便识别用户的语音特征。Windows Vista和Windows 7操作系统中的本地语音转换文本技术和Dragon NaturallySpeaking等第三方产品仍然都需要一个用户训练期才能使用。

  第二个制约因素是键盘的流行程度。大多数人已经习惯于键盘打字而不是讲话,因此,语音控制面临Dvorak键盘布局同样的应用障碍。当简单的老式QWERTY键盘供货充足并且工作的很好的时候,为什么要学习使用Dvorak键盘呢?

  微软TellMe团队是负责为多媒体环境开发语音识别技术的部门。TellMe团队高级产品经理Abhi Rele指出,在台式电脑环境,用户有方便的人机交流模式,如键盘和鼠标。因此,语音的使用主要是针对语音爱好者的。

  语音控制的计算更广泛的应用需要两件事情:更好的方便的应用和主要使用语音的地方。手机正是很长时间以来一直在增长的这种地方。

  Nuance负责产品管理和营销的副总裁Matt Revis解释说,台式电脑和移动环境的区别是这样的:台式电脑是一个固定的环境,重点完全在于台式电脑的使用情况。因此,台式电脑的语音技术主要执行如下任务:支持办公应用程序、网络浏览、通讯等。在移动方面,语音更多地用于支持各种生活方式方面:移动中的专业人员、户外的有趣活动、免提电话等等。

  Gartner分析师Tuong Nguyen赞同这个观点:语音在移动环境中更有意义。他说,从使用的角度看,掌上设备的语音识别功能价值更大。它增加了用户友好的、方便的输入方式。

  Nguyen补充说,如果不用语音技术说出一个简单的说明语句,而是翻动许多菜单或者努力地在小显示屏键盘上进行输入,语音识别的价值就显现出来了。随着触摸屏设备(没有物理键盘)应用的增长,语音识别技术将用来增强数据输入和输出。语音识别还支持免提要求或者法律要求。

  在移动设备方面

  因为移动设备一般仅支持台式电脑的一部分存储和处理功能,语音处理需要一些时间才能以基本的形式出现在手机中。

  语音处理Springer手册解释了手机在2000年代初的情况。尽管那时还有一些局限性,但是,手机经过编程之后能够识别逐个数字的拨号语音,在某种程度上还能识别人的名字。主要问题是内存,因此,大多数手机一次只能识别10个数字或者名字。但是,这些作者指出的另一个问题是这个功能使用的比较少,可能是因为手机厂商在这方面的营销很糟糕。

  随着手机的增加内存和增强处理能力,普通手机的识别能力也增强了。三星电子在2005年发布的售价99美元的SCH-p-207型手机增加了语音至文本的听写功能和语音拨号功能。随着内存达到数百MB和存储容量达到数GB,目前这一代智能手机很少受到限制。

  另一个关键的进步是网络速度。速度更快的无线网络浪潮抬高了许多大船,包括最新一代的语音处理技术。速度更快的网络能够把语音处理任务从网络迁移到远程服务器。

  谷歌语音搜索产品经理Amir Mane解释了速度更快的网络是如何帮助谷歌语音应用程序的。他说,由于所有繁重的处理任务都是由谷歌服务器在网络上处理的,我们减少了掌上设备计算能力的限制。

继续阅读
苹果将pass 64G内存了?今秋决定5G iPhone存储128GB起步

据国外媒体报道,由于芯片等方面的原因,苹果公司未能在去年推出支持5G网络的iPhone,iPhone 11系列最高仍只支持4G。

智能手机未来可以通过NFC直接进行无线充电

NFC标准官方组织NFC论坛(NFC Forum)今天官方宣布,新的“无线充电规范”(Wireless Charging Specification/WLC)已经获得批准,智能手机未来可以通过NFC直接进行无线充电了!

为什么手机APP会如此不安全呢?

打开智能手机,我们可以进行支付、聊天、付款、叫外卖、打车、购物、医院挂号等等,现代人的生活似乎已经离不开这些各式各样的应用软件了。与此同时,功能越来越丰富的背后也隐藏着隐患,危害到用户的信息安全和财产安全。

90Hz以上高刷新率会带来什么?

从国内智能手机市场增长自“向上”变成“向下”那一刻起,国内手机行业就已然变成为一个红海,为了在“红海”市场中求生存,国内手机厂商们纷纷使出各种招式,尤其在功能形态等创新方面可谓是使出浑身解数,都在寻找一个由技术创新带来的新卖点。如果说过去两年智能手机最大的变革,是手机全面屏形态的普及,那么从今年开始,就是全面屏形态下的屏幕刷新率的提升,也就是我们今年常听到的90Hz屏幕。

5G智能手机将在明年爆发

Strategy Analytics新兴设备技术(EDT)研究团队刚刚发布了最新的研究报告《至2024年,全球88国智能手机销量预测按技术划分》,报告预测5G手机将会在2020年飙升,到2025年,几乎每两部手机中就有一部是5G手机。