VIVO手机上的Jovi语音助手现在已经非常实用了,并不是以前那种“人工智障”。它是通过不断更新本地化的语音识别模型以及和系统的深度融合,在各种常见的场景下都能做出迅速而准确的回答——比如调整屏幕亮度、为不同应用程序设定多个闹钟、打开第三方软件、查看日历信息或者获取天气预报等操作都可以一次性完成并且成功率很高。根据官方数据,在中文自然语言处理的任务里,Jovi三年前的意图识别准确率为70%,现在已经提高到了110%左右,并且可以做到离线状态下也能发出一些基本命令来保证用户的隐私安全。

一、语音唤醒和基本命令执行都比较平稳
Jovi可以被唤醒为“小维小维”,在三米以内没有障碍物的情况下唤醒的成功率超过九十八分之一,在比较吵闹或者有轻微背景音乐的地方也能正确地做出反应。被唤醒之后还可以进行多次对话,比如先说“调亮屏幕”,然后再说“再打开微信”,不需要重复说出唤醒词。系统的命令如“打开蓝牙”、“关闭Wi-Fi”、“静音模式”的平均响应时间只有零点八秒,并且都是用本地的NPU来完成的,并不需要依靠网络的支持;第三方应用程序的启动,则是通过深度API直接连接到目标程序上,从而省去了中间页面加载的时间。
第二部分的生活服务类的任务逻辑非常清楚,并且涵盖了所有的内容
Jovi已经接入了Vivo的日历、天气、闹钟、备忘录等原生应用,并且和大部分的生活服务软件完成了符合规定的数据授权对接,在设置了闹钟之后可以直接说出“明天早上七点半叫醒我,听林俊杰唱歌”,系统可以自动识别出时间、人名以及歌曲喜好并且进行相应的设置;查询天气的时候也可以提出比较复杂的疑问比如“下周一三北京有雨吗?”、“上海接下来四十八小时内感觉温度是多少度?”等等,答案都会以结构化的文字加上图表的形式出现在语音反馈界面上而不需要用户自己去点击展开查看;对于二十多个常见的生活指令来说,一次就能被准确地理解和执行掉的比例达到了九十六点五。
第三部分是个性化的适配以及隐私保护机制的改进
用户可以在“Jovi语音助手→语音设置”里开启“方言识别增强”,给粤语、四川话、东北话等六种方言分别配备专门的声音模型来提高识别效果;所有的语音数据都会被保存在本地,并不会上传到云端,在进行转账或者支付的时候需要再次输入指纹或者面部信息才能继续操作;还可以创建一些快捷命令,比如把“回到家”的指令和打开灯的应用程序、调低空调温度以及播放轻柔音乐这三个步骤关联起来,在没有网络的情况下也可以正常工作。
四、存在的问题及改进意见
目前Jovi暂时还不支持跨品牌的智能家居设备直接控制(比如米家、华为HiLink生态系统),需要经过第三方IoT平台进行转发;一些小众的第三方APP还没有开放语音接口,会出现“正在为您查找相关的应用程序”的提示信息。可以先在设置里打开“语义联想”以及“上下文记忆”,这能大大改善多次对话之间的流畅度;第一次使用的时候做三分钟左右的语音校准也很有帮助,可以提高识别鲁棒性的效果。
因此Jovi已经发展成为了一个成熟的可靠系统的语音交互中心,并且具有实用价值、安全性以及可成长性。






评论区 (0)
暂无评论,快来抢沙发吧!
发表评论