首页 > 教程资讯 > 教程详情

Google Cloud 发布 Gemini agent:一个入口处理问答、内容与代码,并可编排 Claude

AI 与前沿 极客小林 2026-10-09
文章分享

Google Cloud 首席执行官 Thomas Kurian 在 Gemini at Work 2026 的主题演讲中发布 Gemini agent。官方博客由这场演讲改写,称它是面向工作的单一、通用 agent。Google Cloud 同时给出采用规模:过去一年近 500 家客户各自处理超过 1 万亿 token,近 80% 的客户在使用其 AI 产品,近 90% 的《财富》100 强在使用 Gemini Enterprise。博客据此表示,企业已经越过试验阶段,开始用这套能力经营业务。

一个 agent 覆盖问答、内容与代码

据这篇博客,Gemini agent 把回答问题、知识工作、生成图像和媒体内容、编写并运行代码集中在一个 agent 和一套 API 中。用户给出目标而不是逐步指令,可以指派任务、设定日程,或让它响应事件。

入口包括网页、iOS 和 Android、Windows 和 Mac 桌面,以及命令行、Google Workspace、Microsoft 365 和 Slack。它也可以作为没有专用界面的 headless agent,嵌入第三方应用。

博客称,agent 在云端运行,无论从哪台设备或哪个渠道进入,都共用一套记忆和上下文。耗时数小时或数天的任务,在笔记本合上之后继续跑。Gemini 还能动态创建带各自身份的临时子 agent,协调可并行或按顺序执行的多步流程。另一类是“同事 agent”:角色更持久,拥有自己的 @agents.company.com 邮箱和独立存储,只能访问用户或团队提供的上下文。在 Workspace 中,这类 agent 拥有邮箱、日历、Drive 和公司通讯录条目,同事可通过 Chat 或 @ 提及与它协作。

同一篇博客写道,Gemini 直接在 Gmail、Drive、Docs、Slides、Sheets、Chat 和 Calendar 里工作,并带上它在其他入口使用的记忆、技能和管控。它还会主动建议可委派的任务。

模型编排、沙箱和花费上限

Google 在博客中把 agent 和底层模型分开:目前在 Gemini 系列与 Anthropic 的 Claude 模型之间编排,按任务选择模型;并称未来会加入其他私有和开源模型。文中表示,最合适的模型不一定是最大的模型。

安全方面,所有 Gemini agent 都在带独立网络边界的 Agent Sandbox 中执行。进、出以及 agent 之间的流量都经过 Agent Gateway。Google 称这是按组织策略实时执行的 AI 网络防火墙。每个 agent 有单独身份,其操作写入审计记录并归属到该 agent,而不是某位员工。

花费控制包括自动分流的 Smart Routing:把企业工作负载分到兼顾表现与成本的模型上。管理员还可在 Cloud Billing Console 为项目设置 AI 花费硬上限。上限触发后,该项目的 agent 暂停,可在控制台一键恢复。由于按项目记账,公司可以把费用分摊到具体部门。

行业版本与 TPU 8i

金融服务和法律两个行业版已进入预览;政府、医疗和零售版本,博客写的是“即将推出”。Google 称金融服务版内置超过 50 项基础技能。基础设施方面,Google 称最新的 TPU 8i 系统比上一代价格性能高 80%。模型侧,博客列出 Argon(前沿推理)、Flash(速度与用量)、Omni(生成式媒体)和 Gemma(轻量、开放权重,面向边缘)。

相关下载

来源