鸿蒙智能体 2.0:从被动应答到主动服务,AI 交互变天了
鸿蒙 7.0 的人工智能升级并不仅仅是端侧的大模型,更重要的是鸿蒙智能体 2.0 架构。不同于传统的语音助手,智能体可以主动地去感知场景、理解需求、完成多项任务。人们认为交互逻辑的改变就是下一代AI终端的主要发展方向。
和传统的语音助手相比,本质的区别就是从工具到助理
传统的语音助手就是一种“指令执行器”。说“设置明天八点钟的闹钟”,它就会执行这个命令;说“打开微信给XX发信息”,它就会打开该应用程序。你要把每一步都说清楚,它只能按照你的命令去做,不能多做一步。
鸿蒙智能体就是“主动助理”。
它可以理解你的意图,并且可以自行拆分步骤去完成任务。比如说下班回家的时候提醒我买瓶牛奶,它会自动判断下班的时间、定位到家附近的超市,在这个时候主动提醒你,不需要你去设定具体的时间和地点。
比如说让你“把今天开的会的会议记录整理出来,发送给参加会议的同事”,它可以自动找到会议录音,进行转换生成会议记录,并找到对应的联系人发送出去,一步完成,不需要你自己去操作。以前的语音助手是“工具”,需要用户自己确定步骤;而现在的智能体则是“助理”,只需要说出目标,它就会自行寻找方法去实现。
核心能力:在各个方面的感知、理解和执行等方面都有所提高
鸿蒙智能体2.0的更新主要是从三个方面进行的。
一是场景感知能力更强。可以利用时间和空间、设备状态以及使用者的习惯等,去推断出你现在的需求。早上来公司后,就会弹出一天的日程表和待办事项;开车时把车载蓝牙连上,就会自动切换成驾驶模式,并且播放通勤歌单;晚上到了睡觉的时间之后,会自动进入免打扰状态,把屏幕亮度调低。不用你自己去调节,在不同的场景下它都会自动调整。
第二就是多步任务执行的能力。以前的语音助手只能执行单一指令,现在的智能体会去处理复杂多步骤的任务。例如,“请帮我预定一张明天下午去上海的高铁票,最好选择靠窗的位置,并且预订一家距离高铁站较近的酒店。”它会自动帮你查询车次、挑选座位、订酒店,全部过程都由它来完成,在过程中如果有问题会向你咨询,不需要你自己动手。
第三种就是个性化的记忆了。它可以记住你的使用习惯和喜好,比如说你常喝什么口味的咖啡、常去哪家餐厅、固定的作息时间等,用得越多就越了解你。不同的人使用,会有完全不一样的感受,做到真正的千人千面。
隐私与边界:主动提供帮助,但是不能越界干涉过多
有人担心智能体会过于聪明,大量搜集个人信息,并且经常干扰人们。鸿蒙的做法是所有的感知和运算都由端侧来完成,数据不会上传到云端,因此隐私安全可以得到保证;另外还有严格的打扰机制,在适当的时机、适合的场景下给出建议,不会出现频繁弹出的情况。
也可以随时关闭智能体的权利,也可以调整它的主动性。喜欢省心的人可以使用全部功能,喜欢安静的人可以只用部分功能,一切都在使用者自己手中。
它没有无所不能的能力,目前主要是做日常的、规范化的任务。需要动脑筋的工作它还是做不了。但是对大部分普通的场景而言,它已经可以帮你省去许多重复且繁琐的操作了。
AI 交互的将来,并不是陪伴你聊天的机器人,而是悄悄替你把琐碎的事情都办好,让你感受不到它的存在。
互动问答:你希望自己能够用人工智能来帮助自己把事情处理好吗?会受到打扰吗?