2026年5月13日,谷歌在线上举办了第二届The Android Show——这是Google I/O的前哨站,也是每年安卓领域最重要的独立发布会。如果你只关注了硬件迭代和系统更新,那你就彻底错过了这场发布会的真正信号。这不是一场Android发布会,而是一场Gemini发布会。Android只是Gemini选择All in落地的"硬件骨架"。
从Chrome浏览器的自动填表操作,到用自然语言生成桌面小组件,再到语音输入的AI化升级——谷歌正在用30亿活跃设备作为底座,把Gemini从一个"应用"变成一个无处不在的"系统级存在"。这背后,藏着谷歌对苹果Apple Intelligence的对标、对中国手机厂商的挑战,以及对"AI超级入口"的终极争夺。
一、Gemini Intelligence:不是功能,而是一个"伞形AI品牌"
这次发布会最大的概念,叫做Gemini Intelligence。很多人第一反应是"又一个AI功能包",但仔细看定义,你会发现谷歌的野心远不止于此。Gemini Intelligence不是一个单一功能,也不是一个App,而是一个伞形AI品牌——它把谷歌多年来在AI领域的所有技术成果打包在一起,然后设定了一个非常明确的准入门槛:只有足够高端的设备,才能用。首发名单是最新一代Pixel和三星Galaxy设备,后续逐步扩展到手表、汽车、眼镜和笔记本电脑。上线时间定在今年夏天。①高端设备优先的策略。谷歌不再追求"AI无差别开放",而是走了一条和苹果Apple Intelligence几乎一模一样的路径——先在旗舰机上跑,再慢慢下放。这背后既有算力限制的现实考量,也有品牌调性的精心设计。②Android从"操作系统"变成了"AI载体"。以前我们说Android是手机操作系统,现在它的角色更像是一个"AI容器"——Gemini Intelligence才是主角,Android只是负责把硬件资源调度好,让AI跑得流畅。③设备分化将加速。能用Gemini Intelligence的手机和不能用的手机,在用户体验上将出现本质区别。这不是简单的"功能有或无",而是"智能与不智能"的分水岭。Gemini Intelligence的适用范围和策略设计,几乎是Apple Intelligence的镜像。18个月前,苹果在WWDC 2024发布Apple Intelligence,同样是高端设备优先、同样强调系统级集成、同样是渐进式落地。谷歌的跟进节奏,几乎踩着苹果的脚印。但有一个关键区别:苹果的iPhone全球活跃设备大约15亿台,而Android设备超过30亿台。如果Gemini Intelligence能成功覆盖哪怕三分之一的高端Android设备,其触达规模也将碾压Apple Intelligence。规模,是谷歌手里最大的牌。
二、四大功能矩阵:Gemini如何接管你的手机?
Gemini Intelligence不是一个概念,它落地到了四个非常具体的功能上,每一个都在改写用户与手机交互的方式。① Rambler:语音输入的AI革命
Gboard的语音输入功能被Gemini接管后,名字变成了Rambler。它做的事情看似简单,但意义深远——当你对着手机说话时,AI会自动过滤填充词("呃""那个")、停顿、自我修正,让你的口语输出直接接近书面表达。这解决的是一个真实痛点。语音转文字技术已经存在多年,但转化出来的文本往往"能看但不能直接用"——充满了口语化的冗余,需要人工润色。Rambler的本质是在语音和文字之间加了一层AI编辑器,让语音输入从"辅助工具"变成了"生产力工具"。想象一下这样的场景:你在开会时对着手机说了一段思路,Rambler自动整理成结构清晰的文字,可以直接粘贴进文档或邮件。不用再手动删减那些"嗯""然后""就是说"了。这背后依赖的是Gemini的语言理解能力,而不仅仅是传统的语音识别。这也是为什么Rambler只能运行在高端设备上——它需要端侧大模型的推理能力。② Create My Widget:一句话生成桌面组件
用户可以用自然语言描述需求,比如"每周推荐三个高蛋白健身餐",AI就直接生成一个自定义的桌面小组件。这个功能听起来像一个"小玩意",但它指向的方向非常明确:让桌面变得千人千面。传统的桌面组件是静态的、预设的——天气、时钟、日程,千篇一律。Create My Widget把定义权交给了用户,AI负责把模糊的自然语言转化为具体的UI组件。这不仅降低了定制门槛,还创造了一种全新的"AI生成界面"范式。如果这个方向跑通,未来你的手机桌面可能完全由AI根据你的习惯和需求来"设计"——每天都不一样。③ Chrome Auto Browse:手机端的AI Agent首次落地
Chrome Auto Browse可以让AI代替用户在网页上执行操作——滚动、点击、填表单、订停车位、修改订单,等等。它不是简单的"帮我打开这个网页",而是"帮我完成这个任务"。这是手机端AI Agent的首次真正落地。之前我们讨论AI Agent,大多是在PC端的编程辅助(比如Claude Code、Codex),或者是概念化的"数字员工"。Chrome Auto Browse把Agent的能力放进了每个人的手机浏览器里。它的工作方式是这样的:用户告诉Chrome"帮我在SpotHero订一个明天上午10点到下午2点的停车位",Auto Browse会自动打开网站、输入信息、选择时间、完成支付——整个过程中用户不需要手动操作任何步骤。这标志着AI从"对话式助手"进化为"操作式助手"。
以前你问AI"附近哪里有停车场?",它给你一个列表;现在你告诉AI"帮我订一个停车位",它直接帮你搞定。从"信息检索"到"任务执行"——这是一个质的跨越。当然,Chrome Auto Browse目前还有很多限制。它需要网站支持(不是所有网站都能操作),安全性和隐私保护也需要时间验证。但方向已经非常明确:浏览器将成为AI Agent的核心载体之一。④ Gemini自动操作:系统级的AI执行引擎
与Chrome Auto Browse针对网页操作不同,Gemini自动操作是系统级的——它可以跨App执行任务,不需要通过浏览器。比如你可以说"帮我把昨天拍的照片发到群里",Gemini会自动打开相册、选择照片、打开聊天App、发送——全程不需要你手动操作。这背后的技术逻辑是:Gemini获得了系统级的权限,可以像用户一样操作手机上的任何App。AI不再是一个独立的App,而是变成了手机操作系统的"大脑"。
三、Googlebooks:一个全新硬件品类诞生了
如果说Gemini Intelligence是软件层的战略,那么Googlebooks就是硬件层的战略——而且是一个全新的硬件品类。注意,不是Chromebook,是Googlebooks。两者虽然名字相似,但定位完全不同。Chromebook是"用浏览器办公的笔记本",而Googlebooks是"为Gemini量身定做的AI电脑"。合作厂商名单非常值得关注:Acer、Asus(Chromebook的老伙伴),以及Dell、HP、Lenovo——这三家是传统的Windows阵营大厂,如今全部加入谷歌的新硬件生态。Magic Pointer:用鼠标指向任意内容,即可唤起Gemini进行上下文交互。比如你指向一段文字,Gemini自动帮你翻译、总结或续写。这不是简单的"选中文本右键翻译",而是AI对上下文的理解——它知道这段文字在说什么、你在做什么,然后给出最相关的辅助。Create My Widget(桌面版):和手机端同样的功能,扩展到桌面系统。在电脑上用自然语言生成定制化的桌面组件。Cast my apps:将手机应用投屏至笔记本大屏。不是简单的镜像,而是"投屏后可以继续操作",手机变成了电脑的一个扩展屏幕。Quick Access:在笔记本上直接浏览手机内的文件。手机和电脑的文件系统打通,不需要数据线或云盘中转。谷歌的战略意图非常清晰:用Gemini Intelligence重新打开电脑市场。Chromebook已经14年了,始终未能撼动Windows的市场地位。如今谷歌换了一个思路——不再强调"浏览器即操作系统",而是强调"AI即操作系统"。Googlebooks的核心卖点是Gemini,不是Chrome。这是一个更加激进但也更加聪明的策略。因为AI的竞争格局和浏览器时代完全不同:谷歌在AI领域有自己的大模型(Gemini)、有自己的硬件生态(Android/Chromebook/Pixel)、有自己的云基础设施(Google Cloud)——这些积累让Googlebooks有了一个Chromebook从来没有过的起点。但风险同样不可忽视。Windows PC的生态壁垒极高,企业用户对Windows的依赖不是Gemini能够轻易替代的。Googlebooks更可能在消费端和教育端找到突破口。
四、Android 17与Android Auto:AI渗透的常规化
除了Gemini Intelligence和Googlebooks,这次发布会还带来了Android 17的系统更新和Android Auto的车机更新。Android 17面向创作者的几个新功能值得关注:Screen Reactions:同时录制人脸和屏幕画面。这是面向视频创作者的实用功能,解决了"录屏时看不到创作者表情"的痛点。数字健康功能Pause Point:打开应用时强制暂停10秒,引导用户自问"我为什么打开这个应用"。这个设计非常巧妙——它不是限制使用时间,而是让用户"主动思考"自己的使用行为。这是一种AI驱动的"数字正念"(Digital Mindfulness)。Noto 3D Emoji:Emoji表情全面重新设计为3D版本。虽然这不是AI相关功能,但它暗示了谷歌在视觉层面的新方向——更立体、更生动、更接近"数字生命"的质感。Android Auto的更新则是常规迭代,采用了Material 3 Expressive设计语言,支持Dolby Atmos空间音频。但有一个信号值得关注:Android Auto也成为了Gemini的入口。汽车场景下的AI交互正在加速落地。
五、谷歌的真正对手:不是苹果,而是中国手机厂商
表面上看,谷歌Gemini Intelligence的对标对象是苹果Apple Intelligence。但如果把视野拉大到全球手机市场,你会发现谷歌面临的真正挑战,来自中国。Gemini Intelligence的中国落地前景非常不乐观。原因很简单:中国手机厂商都有自己的AI体系。小米有澎湃OS(HyperOS),内置自研AI助手OPPO有AndesGPT,深度集成于ColorOS这些国产AI系统各有所长,而且都已经在手机端实现了深度的系统级集成。在中国市场,Gemini Intelligence几乎没有落地的空间。即使是在三星Galaxy设备上,谷歌的话语权也需要与三星自己的Galaxy AI品牌分享。Galaxy AI已经独立运营了两年,三星在这条路上已经有了自己的积累和用户认知。谷歌要把Gemini Intelligence作为统一品牌"收编"所有Android设备的AI能力,三星未必会完全配合。Android碎片化的老问题,在AI时代变成了一个新问题。
谷歌的30亿设备优势是真实的,但"30亿设备"和"30亿台能跑Gemini Intelligence的设备"之间,隔着厂商博弈、地缘政治和用户习惯三座大山。
六、从Android到Gemini:一场关于"超级入口"的终极战争
第一步:把Gemini嵌入Android的每一个角落,让AI从"可选功能"变成"系统默认"。
Chrome Auto Browse、Rambler、Create My Widget、Gemini自动操作——这些功能的共同点是,它们不是让你"主动去找AI",而是让AI"主动出现在你的每一个操作中"。你打开浏览器,AI帮你填表;你按住语音键,AI帮你整理语言;你看向桌面,AI帮你定制组件。第二步:用Googlebooks开辟PC端战场,让Gemini从手机延伸到电脑。
Magic Pointer、跨设备文件访问——这些功能的核心不是"方便",而是"AI无处不在"。当你的鼠标、键盘、屏幕都被AI接管后,Gemini就不再是一个"工具",而是你与数字世界交互的"界面"。第三步:通过设备规模优势,碾压所有竞争对手。
苹果有15亿台iPhone,但Android有30亿台设备。即使Gemini Intelligence只覆盖20%的高端Android设备,也有6亿台——远超Apple Intelligence的覆盖范围。这场战争的终极目标,不是"谁的模型更强",而是"谁能成为用户与AI交互的第一入口"。OpenAI有ChatGPT + Codex的闭环;Anthropic靠Claude Code吃掉了开发者入口;Meta押注开源生态。谷歌有什么?答案是:30亿台Android设备,以及即将上市的Googlebooks。模型的差距可以追,但设备规模的差距很难追。这就是谷歌最大的底牌,也是Gemini Intelligence最值得关注的理由。
结语
2026年5月13日的The Android Show,表面上是Android的一场常规发布会,实际上是谷歌Gemini战略的一次总动员。从Chrome Auto Browse的手机端Agent落地,到Googlebooks的全新硬件品类,再到Gemini Intelligence的伞形品牌设计——谷歌正在用一种前所未有的方式,把AI"焊接"进操作系统的DNA里。这场赌博的筹码是30亿台设备,对手是苹果、中国手机厂商,以及所有想要成为"AI超级入口"的玩家。Android不再只是一个操作系统,它是Gemini通往用户手中每一块屏幕的桥梁。
(本文信息综合自腾讯新闻、知乎、AI工具集、澎湃新闻、凤凰网科技等)