谷歌正在安卓系统里全面强化Gemini AI的能力,覆盖范围从系统级的自动操作,到可以直接生成个性化桌面组件。
在今年I/O开发者大会前夕的Android专场活动上,谷歌再次把重心放在了自家大模型Gemini上,宣布了一系列围绕“帮你操控手机”的新功能,覆盖Chrome浏览器、系统自动填表以及更多应用场景。
谷歌同时推出了一个全新的概念名称叫“Gemini Intelligence”。据谷歌Android体验总监介绍,这个概念代表“在最高端的Android设备上释放Gemini的最佳能力”,本质上是对现有和新功能的一次打包整合,主要面向Galaxy S26等高端旗舰机型,形成一个类似“高级Android体验”的功能集合。
这个集合的核心是之前已经在部分Pixel和三星Galaxy新机上测试过的任务自动化功能。该功能允许Gemini直接在手机上代为操作特定应用,之前主要支持叫车和外卖等少数App,现在谷歌宣布将“很快”开放到更广泛的应用生态中。此外,任务自动化也将从仅支持语音和文本指令升级为多模态输入,用户可以通过截图或照片来触发操作。比如把笔记应用里的一张购物清单截图交给Gemini,由它在电商或买菜平台里自动添加购物车——前提是设备本身支持Gemini Intelligence。
在Gemini Intelligence旗下,谷歌还首次公布了一项叫“Create My Widget”的新功能,被官方视作迈向“生成式界面”的第一步。用户只需用自然语言描述自己想要的小组件功能,Gemini就能自动生成对应的桌面组件。谷歌给出的示例包括:为骑行爱好者定制一块突出显示风速和降水概率的天气组件,或者每周自动推荐“三个高蛋白备餐菜谱”的食谱组件。生成后,这些组件不仅会出现在手机桌面,还会同步扩展到Wear OS智能手表上,形成跨设备的统一体验。
从交互理念上看,谷歌希望用户把组件看作“可以随手用AI写在桌面上的迷你应用”,从而推动界面形态向即时生成、按需变化的方向演进。业界也由此关注,谷歌是否会在I/O大会上进一步阐述“生成式UI”的长期路线:是让界面真正按场景即刻重构,还是更多停留在组件层面的个性化尝试。
除了系统层的功能,谷歌还把Gemini的部分桌面端能力搬到了Android版Chrome浏览器中。未来用户会在Chrome里看到一个独立的Gemini按钮,可以直接把当前网页内容分享给Gemini,并在浏览器内部就页面信息提问或生成摘要。对于订阅了Google AI Pro或Ultra计划的用户,Chrome还会提供“自动浏览”辅助来完成任务,比如自动帮你在网站间跳转、填信息并完成预约。这个功能预计6月下旬开始逐步推送。
在系统层的另一个重要入口——自动填表方面,Gemini也将“有条件地”更深度介入。谷歌表示,用户可以选择把Gemini接入Android的自动填充功能,由它协助填写各类表单。为此,Gemini会借助所谓的“个人智能”接口,在获得授权的情况下从Google Photos、Gmail等个人数据源中检索相关信息,例如自动识别照片里的车牌号并填入表格。这种做法一方面明显提升了填写效率,另一方面也引发了关于隐私和便利边界的新讨论——到底是极其贴心,还是有点诡异,留给用户自己判断。
根据谷歌的规划,Gemini Intelligence旗下的各项功能将在今年内“分批次、按成熟度”陆续上线,首批推送对象仍然是三星Galaxy和谷歌Pixel等高端Android机型,预计从今夏开始陆续收到更新。





