谷歌的Gemini Live变得更智能,但它真的能包办一切吗?
谷歌最近为Gemini Live(其支持语音的AI助手)推出了一项更新,目标很明确:让用户只需自然说话就能完成任务。无需再翻找菜单或弄清楚哪个工具做什么。只需说出你的需求,Gemini就会处理其余的事情。
但问题来了——即使有了这次升级,Gemini仍然将聊天、Spark和每日简报作为独立功能呈现,每个都有自己的图标和入口。所以,尽管谷歌在谈论简化,用户仍然需要了解这些功能之间的区别。这有点像遥控器按钮更少了,但仍然需要说明书。
以每日简报为例。它从Gmail、日历和其他谷歌服务中提取数据,为你提供主动更新。听起来很方便,但它的过滤并不完美。你可能会收到与当前无关的提醒,这可能会比有帮助更烦人。另一方面,Spark是一个可以实际执行任务的AI代理——更接近我们对真正智能助手的期望。但将其单独品牌化意味着用户必须了解每个功能的作用,增加了学习曲线。
这不仅仅是Gemini的问题。在整个AI行业,有一种趋势是将内部架构暴露给用户——聊天模式、代理模式、协作模式,等等。但大多数人并不关心模式。他们只想说,“嘿,帮我订一张去东京的机票”,然后完成它。他们不想考虑这是聊天任务还是代理任务。
行业专家认为,AI助手的未来在于隐藏这种复杂性。模型、代理、工具——所有这些都应该留在后台。苹果对Siri的处理方式,以及一些基于文本的AI代理,已经强调通过熟悉的聊天界面完成任务。随着AI能力的增强,真正的竞争可能在于谁能将体验变得如此直观,以至于用户永远不必学习新的逻辑。
那么,Gemini Live会兑现它的承诺吗?只有时间能证明。但有一件事是肯定的:那个感觉不像工具而更像乐于助人的朋友的AI,将赢得我们的心。
要点:
- 谷歌的Gemini Live更新旨在让用户通过语音命令完成任务,但仍将聊天、Spark和每日简报功能分开。
- 每日简报的主动更新可能不准确,而Spark作为任务执行代理显示出潜力。
- AI行业经常向用户暴露复杂的模式,但未来在于隐藏这种复杂性。
- 成功的AI助手将使交互感觉自然,就像与朋友交谈,而不是操作机器。