Google 在北京时间 5 月 20 日凌晨结束 I/O 2026 主 Keynote 后,把今年的主线明确放在“agentic Gemini era”上:模型从回答问题继续转向执行任务,Search、Gemini 应用、Android、Workspace、开发者工具和创作产品都围绕 24/7 智能体展开。根据 Google 官方博客、The Keyword、Android Developers Blog 以及 Engadget、Wired、TechRadar 等英文媒体的同步汇总,本次大会没有只发布单一模型,而是一次覆盖模型、搜索入口、系统级 AI、视频生成、办公套件和 AI 基础设施的大更新。
最核心的新模型是 Gemini 3.5 Flash。Google 称,Gemini 3.5 是一组“frontier intelligence with action”的新模型,首个开放的是 3.5 Flash;它已经从发布当天起面向 Gemini 应用、Google Search 的 AI Mode、Google Antigravity、Gemini API、Google AI Studio、Android Studio、Gemini Enterprise Agent Platform 和 Gemini Enterprise 开放。Google 官方给出的关键数据包括:3.5 Flash 在 Terminal-Bench 2.1 上达到 76.2%,GDPval-AA 为 1656 Elo,MCP Atlas 为 83.6%,CharXiv Reasoning 为 84.2%;按输出 token 速度看,它比其他前沿模型快 4 倍。Google 还称,3.5 Flash 在多数基准上超过 Gemini 3.1 Pro,并且在内部开发工具中已把 Google 的 AI 开发 token 处理量从 3 月的每天约 5000 亿 token推到目前每天超过 3 万亿 token。
Google 也确认了 Gemini 3.5 Pro 的时间表:3.5 Pro 已在内部使用,但不会在 I/O 当天开放,计划在“下个月”推出。大会现场和官方博客都没有公布 3.5 Pro 的参数规模、上下文长度、API 价格或完整跑分,因此这些数字目前不能补写。
围绕智能体,Google 发布了面向消费者的 Gemini Spark。Spark 被定义为 Gemini 应用里的 24/7 个人 AI 智能体,由 Gemini 3.5 和 Antigravity harness 驱动,可以在用户授权下跨 Gmail、Docs、Slides 等工具执行长周期任务。官方举例包括解析信用卡账单、追踪学校邮件、整理会议记录并生成 Google Docs 和邮件草稿。Spark 本周开始向 trusted testers 推出,计划下周面向美国 Google AI Ultra 订阅用户开放 Beta;Google 还说,未来几周 Spark 会通过 MCP 接入第三方工具,已宣布的连接包括 Canva、OpenTable 和 Instacart。对于高风险操作,例如付款或发送邮件,Spark 会先询问用户。
Gemini 应用本身也获得了大改版。Google 称,Gemini 应用去年 I/O 时月活用户为 4 亿,今年已经超过 9 亿,覆盖 230 多个国家和地区、70 多种语言,日请求量一年增长超过 7 倍。新版界面采用 Neural Expressive 设计语言,5 月 19 日起面向 Web、Android 和 iOS 全球推出。Google 还发布 Daily Brief,用于每天早上从 Gmail、Calendar 和任务中生成个性化摘要;Daily Brief 从发布日起先向 Google AI Plus、Pro 和 Ultra 订阅用户推出,首发地区为美国。
Search 是本次 Keynote 的另一个重点。Google 称 AI Overviews 月活用户已经超过 25 亿,AI Mode 上线一年后月活已经超过 10 亿,AI Mode 查询量自上线以来每季度增长超过 2 倍。从 5 月 19 日起,AI Mode 的默认模型升级为 Gemini 3.5 Flash,并且面向全球用户开放。Google 还发布了 25 年来最大的一次搜索框升级:新的 AI 搜索框可以动态展开,支持文本、图片、文件、视频和 Chrome 标签页作为输入,并在 AI Mode 可用的国家、地区和语言中开始推出。AI Overview 内也加入了继续追问的入口,用户可以从概览直接进入与 AI Mode 的连续对话。
Search 的“代理化”主要体现在三类功能。第一是信息代理,用户可以让它 24/7 后台追踪网页、新闻、社交内容以及金融、购物、体育等实时数据,并在条件满足时生成摘要和下一步行动建议;该功能今年夏天先向 Google AI Pro 和 Ultra 订阅用户推出。第二是预订和本地服务代理能力,Google 称今年夏天将在美国面向所有用户扩展到本地体验和服务,例如按条件寻找 6 人包间、查询价格和可订状态;在家庭维修、美容、宠物护理等部分类别中,Search 还能代表用户致电商家。第三是生成式 UI 和小应用:Search 将使用 Antigravity 和 Gemini 3.5 Flash 为问题实时生成交互图表、模拟器、仪表盘或追踪器,生成式 UI 今年夏天免费面向所有用户推出,而更持久的自定义 mini apps 将在未来几个月先向美国 Google AI Pro 和 Ultra 订阅用户开放。
在视频生成和多模态创作上,Google 发布 Gemini Omni,首个模型为 Gemini Omni Flash。官方描述是“从任何输入生成任何输出形态”,首发聚焦视频:用户可以把文本、图片、视频和音频组合为输入,生成高质量视频,并通过自然语言进行多轮编辑。Google 强调 Omni 能保持角色一致性、理解物理关系,并可结合 Gemini 的现实知识生成解释型视频;发布时支持的视频样例包括 10 秒短片和 24fps 的多对象序列。Gemini Omni Flash 从发布日起向 Google AI Plus、Pro 和 Ultra 订阅用户在 Gemini 应用和 Google Flow 中全球推出,本周也会在 YouTube Shorts 和 YouTube Create App 免费开放;开发者和企业 API 将在未来几周推出。所有 Omni 生成视频都会包含不可见的 SynthID 水印。
Google Flow 也继续扩张。Google 表示 Flow 去年从面向电影创作者的工具起步,现在已覆盖全球 140 多个国家,并加入 Google Flow Agent、Flow Tools、Gemini Omni Flash 和移动端应用。Flow Agent 已向全球所有 Flow 用户开放,可参与构思、生成、编辑、批量修改和素材整理;Flow Tools 允许用自然语言创建自定义图像编辑器、视频尺寸调整器或 shader 等工作流,全球用户都能使用现有工具,Google AI 订阅用户还能创建和 remix 工具。Flow Android 应用以 beta 形式面向 18 岁以上用户开放,iOS 版稍后推出;Flow Music iOS 应用已经上线,Android 版稍后推出。
Workspace 方面,Google 称 Gmail、Docs、Drive 等 Workspace 应用拥有超过 40 亿用户。本次发布的 Docs Live、Gmail Live 和 Keep 语音能力,重点是让用户用语音搜索邮件、整理想法或生成文档。Docs Live 可以把口述内容组织成初稿,并在用户允许时从 Gmail、Drive、Chat 和网页中拉取相关细节;Gmail Live 可以通过语音询问邮件中的航班登机口、学校通知等信息;Keep 可以把口述内容整理为笔记和清单。这些语音功能将在今年夏天面向 Google AI Pro 和 Ultra 订阅用户推出,并向 Google Workspace 商业客户预览。
Google 还发布了 Google Pics,这是一个基于最新 Nano Banana 模型的 AI 图片生成和编辑工具。它不是把图片当作静态整体处理,而是允许用户选择、移动、缩放或替换具体对象,支持直接编辑图片中的文字、翻译文字并尽量保留原有版式和字体,还会先接入 Slides 和 Drive。Google Pics 从发布日起先向少量 trusted testers 开放,今年夏天全球推向 Google AI Pro 和 Ultra 订阅用户,并向 Workspace 商业客户预览。Gmail 的 AI Inbox 也扩大开放:此前 AI Inbox 已面向 Google AI Ultra 订阅用户和 Workspace Enterprise Plus 客户预览,现在开始向美国 Google AI Plus 和 Pro 订阅用户推出,并加入个性化回复草稿、相关 Docs/Sheets/Slides 文件快捷入口和任务管理更新。
Android 侧的新内容是 Android Halo。这是一个显示在手机屏幕顶部的系统级状态区域,用来展示 Gemini Spark 等 AI 智能体正在做什么、进度如何、是否进入 live mode 或发送消息。Android Halo 将在今年晚些时候推出,适配 Gemini Spark 和其他受支持智能体;Google 称在搭载 Gemini Intelligence 的高端设备上还会有额外能力,但具体机型和完整功能要晚些时候公布。智能眼镜方面,Google 在 Keynote 中继续展示了 Android XR 与 Gemini 结合的方向。Engadget 等英文媒体同步提到,Google 与 Samsung 展示了 Android XR 智能眼镜原型,重点是把 Gemini 放进免手持的视觉/语音交互中;但现阶段公开信息仍以演示和路线图为主,价格、上市国家、完整硬件参数和明确发售日期尚未公布。
开发者工具是本次 I/O 的重头戏。Google 发布 Antigravity 2.0,从编码环境扩展为一个可管理多智能体的独立桌面应用,支持并行任务、动态 subagents、计划任务以及与 AI Studio、Android、Firebase 的集成。Google 还推出 Antigravity CLI 和 Antigravity SDK,并在 Gemini API 中加入 Managed Agents。Managed Agents 允许开发者通过一次 API 调用启动一个能推理、使用工具并在隔离 Linux 环境中执行代码的智能体;每次 interaction 会创建可在后续调用中恢复的环境,保留文件和状态。Google AI Ultra 也新增一个起价 100 美元/月的方案,相比 Google AI Pro 在 Antigravity 中提供 5 倍使用上限;5 月 25 日前,Google 还给新老 Ultra 用户提供 100 美元Antigravity 额外额度。另一个独立的 Project Genie 访问仍标注为面向符合条件的 Google AI Ultra 200 美元订阅用户。
Google AI Studio 则开始支持原生 Android 应用生成。开发者可以在 Build 标签里选择“Build an Android app”,用自然语言生成 Kotlin 和 Jetpack Compose 代码,并在浏览器中用 Android Emulator 预览,或通过 ADB 安装到设备。AI Studio 还支持连接 Google Play Developer 账号,把应用一键发布到 Google Play Internal Test Track。Google 同时宣布 AI Studio 移动应用本周开放预注册,Workspace API 可被 AI Studio 内应用直接调用,并允许把 AI Studio 项目连同对话历史、项目文件和 secrets 一起导出到 Antigravity。对新手开发者,Google 还宣布可免费部署前两个应用到 Google Cloud,且不需要信用卡;已有计费项目会继续使用 Cloud Run Free Tier。
在基础设施层面,Google 给出了一组很夸张的 AI 用量和硬件数据。Sundar Pichai 称,两年前 Google 各产品每月处理 9.7 万亿 token,去年 I/O 时增长到约 480 万亿 token,今年已经达到每月超过 3.2 千万亿 token;现在每月有超过 850 万开发者使用 Google 模型构建应用,Google 模型 API 每分钟处理约 190 亿 token;过去 12 个月内,有超过 375 家Google Cloud 客户各自处理了超过 1 万亿 token。Google 还披露今年资本开支预计约 1800 亿至 1900 亿美元,约为 2022 年 310 亿美元的 6 倍。
新硬件是第八代 TPU:TPU 8t 和 TPU 8i。TPU 8t 面向大规模训练,单个 superpod 可扩展到 9600 个芯片,拥有 2 PB共享高带宽内存,芯片间带宽较上一代翻倍,算力达到 121 ExaFLOPS,并通过 JAX、Pathways 和 Virgo Network 支持最多 100 万个芯片的单一逻辑集群近线性扩展。TPU 8t 的目标 goodput 超过 97%,并称可把前沿模型开发周期从数月压到数周。TPU 8i 面向低延迟推理,配备 288GB高带宽内存和 384MB片上 SRAM,SRAM 是上一代的 3 倍;ICI 带宽提升到 19.2Tb/s,Boardfly 架构把最大网络直径降低超过 50%,片上 Collectives Acceleration Engine 可把延迟最多降低 5 倍。Google 称 TPU 8i 相比上一代性能/美元提升 80%,两款芯片性能/瓦最高提升 2 倍,并计划今年晚些时候正式可用。
最后,Google 也把 AI 购物纳入智能体路线。Universal Cart 是一个跨商家、跨服务的智能购物车,可在 Search、Gemini、YouTube 或 Gmail 中加入商品,并在后台追踪降价、补货、价格历史和兼容性问题。Google 称 Shopping Graph 目前包含超过 600 亿商品列表,Google 上每天发生超过 10 亿次购物行为。Universal Cart 将在今年夏天先于美国的 Search 和 Gemini 应用推出,YouTube 和 Gmail 随后接入;部分结账能力将先覆盖 Nike、Sephora、Target、Ulta Beauty、Walmart、Wayfair 以及 Shopify 商家中的 Fenty、Steve Madden 等。Google 还说,Universal Commerce Protocol 驱动的结账体验未来几个月将扩展到加拿大和澳大利亚,之后扩展到英国;Agent Payments Protocol 会先从 Gemini Spark 开始接入 Google 产品。
总体来看,Google I/O 2026 的重点不是单点“炫技”,而是把 Gemini 3.5 Flash、Antigravity、Gemini Spark、Search agents、Android Halo 和 Workspace 语音/创作功能连成一条线:模型更快、更便宜,智能体开始 24 小时后台执行任务,入口则覆盖搜索框、手机系统、办公软件、浏览器和创作工具。不过,一些外界最关心的信息仍然缺失,例如 Gemini 3.5 Pro 的正式发布日期、上下文长度、API 单价、智能眼镜价格和上市地区,Google 官方目前都没有给出明确数字。
来源:Google 官方博客 The Keyword、Google Developers Blog、Android Developers Blog、Google Cloud Blog、Google I/O 2026 官方发布集合;英文媒体交叉核对:Engadget、Wired、TechRadar。