谷歌云于 10 月 8 日在 Gemini at Work 2026 活动上发布 Gemini Agent,将其定位为「通用工作智能体」(universal agent for work)。与需要从头编写操作步骤的传统助手不同,这款产品强调「只给目标、不给指令」:用户设定想要达成的结果,智能体自行规划步骤、调用工具、连接企业系统并返回已完成的工作。
一个界面,覆盖问答、创作与编程
谷歌云 CEO 托马斯·库里安(Thomas Kurian)在发布中表示,用户应向 Gemini Agent 提供「目标而非指令」,把任务委托出去后,回来即可拿到完成的工作。要实现这一点,智能体必须接入个人工作流、记录系统与企业的管控体系。
据官方介绍,Gemini Agent 可从单一界面与单一 API 完成三类核心任务:回答业务问题、自主推进用户分配的目标,以及生成代码。它支持任务分配、进度排期,并能对事件做出响应;接入范围覆盖网页、iOS 与 Android 设备、Windows 与 Mac 桌面、命令行,以及 Google Workspace、Microsoft 365 和 Slack,也能以无界面(headless)方式嵌入第三方应用运行。
可调用多家模型,并组建子智能体
在模型选择上,Gemini Agent 当前可在谷歌 Gemini 系列模型与 Anthropic 的 Claude 模型之间动态路由,为不同任务匹配最合适的模型以兼顾质量与成本;谷歌云表示,未来还将支持更多私有与开源模型。
对于跨时长、多步骤的复杂任务,Gemini Agent 能动态创建临时子智能体(sub-agent),每个子智能体拥有独立身份并协同推进并行或串行步骤。在「同事模式」下,智能体获得持久且明确的角色,并配有专属的 @agents.company.com 邮箱地址与独立存储空间,仅能访问用户或团队成员提供的上下文。
深度连接企业系统
Gemini Agent 通过工具层接入大量企业软件与数据源,包括协同类(Confluence、Microsoft Office、Teams、Slack、Workspace)、开发类(Git、Jira)、企业平台(Salesforce、ServiceNow)以及数据库(BigQuery、Databricks、Postgres、Snowflake)等,并支持模型上下文协议(MCP)在内外网安全集成。官方还提供企业工具注册表与技能注册表,供团队构建与复用工作流。
在治理层面,Gemini Agent 内置身份、授权与权限、审计、策略管理与成本控制能力,模型编排、智能路由与实时支出上限(real-time spending caps)共同用于约束开销。
早期客户验证成效
谷歌云披露的数据显示,过去一年里已有近 500 家客户各自处理了超过 1 万亿 token,近 80% 的谷歌云客户在使用其 AI 产品,近 90% 的财富 100 强企业使用 Gemini Enterprise。
在具体落地案例中,运动品牌 On 测试了智能体的动态模型选择能力;Shopify 为数百万商家融合前沿模型;PayPal 每周路由 1000 万次多模型请求。巴西布拉德斯科银行(Bradesco)将文档审阅时间从 1 小时压缩到 5 分钟;西班牙电信运营商 Orange Spain 已部署超过 1000 个自定义 Gemini Enterprise 智能体,用于故障分诊与网络分析。







