一、谷歌云:Gemini Agent ——「给目标,交成果」的工作智能体

在 Gemini at Work 2026 大会上,谷歌云 CEO Thomas Kurian 发布 Gemini Agent,定位为「单一、通用的企业工作智能体」。其设计围绕五条架构原则:
能力 |
说明 |
统一入口 |
一个提示框完成问答、知识工作、图像/媒体生成与代码编写运行;用户下达「目标」而非「指令」,回来的是成品 |
无处不在的访问 |
Web、iOS、安卓、Windows、Mac,以及 Google Workspace、Microsoft 365、Slack、命令行;支持无界面(headless)嵌入第三方应用 |
持久化执行 |
云端运行,跨设备共享同一套记忆、上下文与个性化图谱;关掉笔记本后任务仍可持续数小时乃至数天 |
多代理编排 |
动态生成带独立身份的临时「子代理」并行/串行协作;也可作为长期「同事代理」,拥有专属邮箱 @agents.company.com、持久存储与目录身份 |
多模型路由 |
编排层独立于 Gemini 模型家族,按任务在 Gemini 与 Claude 等模型间切换;Smart Routing 选性价比最优模型,命中实时支出上限自动暂停 |
落地细节:Gemini Agent 直接嵌入 Gmail、Drive、Docs、Slides、Sheets、Chat、Calendar,并带来四种记忆类型(会话/语义/程序/情景记忆)。安全治理上提供身份与策略管理、授权权限控制、安全沙盒、网络网关,且每一次动作均带唯一标识可被审计。行业专属版本已进入预览——金融版接入 FactSet、LSEG 并内置 50+ 技能,法律版对接 NetDocuments、iManage。
规模与节奏:谷歌称近 80% 谷歌云客户已使用其 AI 产品,近 90% 的《财富》100 强采用 Gemini Enterprise;Shopify 用前沿模型混合服务数百万商户,PayPal 每周路由约 1000 万次多模型请求。产品目前为私有预览,Workspace 客户计划于选定 Business/Enterprise 方案上广泛可用。
行业意义:谷歌把「通用工作智能体」做成了编排层,并主动接入竞品 Claude,意味着底层模型能力正被「路由」商品化,竞争焦点转移到企业治理、记忆与成本掌控。
二、OpenAI:GPT-6 + Intelligent UI,以及被「单独定价」的速度

GPT-6 与 Intelligent UI
OpenAI 在 ChatGPT 中推出 GPT-6 + Intelligent UI:ChatGPT 现在可在回答中融合文本、视觉与可交互组件——并排对比、动态图示,以及对话内直接可用的计算器、AA 制、小游戏等工具;系统自动择定格式,纯文本仍作为兜底。
关键特性与可用范围:
- 边想边答:GPT-6 可在继续思考/调用工具的同时开始输出,无需二次提示即可补充发现;
- 分层可用:Plus / Pro / Business / Enterprise 在 Chat 标签页当日全球推送,次日扩展至 Free / Go;Enterprise 取决于管理员设置;
- 模型映射:Plus/Pro/Business/Enterprise 用 GPT-6 Sol,Free/Go 用 GPT-6 Luna;Intelligent UI 在 Instant 至 Extra High 推理档可用,Pro 的 Astra 档不支持;Work 与 Codex 底层模型不变。
GPT-6.1 Sol 的 Ultrafast 极速档
GPT-6.1 Sol 本体已于 9 月 29 日发布;10 月 8 日 OpenAI 在 Responses API 为其新增 Ultrafast 档(设置 service_tier: "ultrafast"),向所有 API 用户开放(受速率限制)。
定价与性能(官方口径):
项目 |
数据 |
速度定位 |
最快 API 档位,面向延迟敏感场景 |
单价 |
极速约为标准档 6 倍、快速档 3 倍;输入 >27.2 万 token 时极速输入/输出升至 $24 / $90 每百万 token |
套餐额度消耗 |
极速消耗订阅内额度速度为标准档 8 倍 |
性能 |
官方定位「以更低成本接近 GPT-6 Astra」;DeepSWEv1.1 中以约 1/5 成本达 Astra 水平;AutomationBench 中等推理强度超 Opus 5.5 约 2.2 个百分点、成本约其 1/3 |
可用性 |
API 全量开放;ChatGPT 端极速仅限 Pro $500 档及符合条件 Enterprise/Edu,且 Sol 模型不进普通 Chat |
争议点:开发者在 X、Reddit 讨论集中两点——一是极速「6 倍价≠6 倍速」,价值取决于等待时间花在模型生成还是外部工具;二是额度消耗快、功能分层(500 美元档专属)引发付费用户不满,部分用户反馈更新后 Codex 工具调用出现稳定性问题。OpenAI 建议持续调用工具者使用 WebSocket 以保住延迟收益。
行业意义:OpenAI 把「模型能力」与「运行速度」拆成可分别计费的产品维度,「速度开始单独定价」,标志智能体时代延迟本身就是商品。
三、Anthropic:Claude Sonnet 5.5 + Dashboards/Motion 直插 BI 与动效赛道

Claude 5.5 家族与 Sonnet 5.5
Anthropic 以 Claude 5.5 模型家族支撑本轮更新:Opus 5.5 负责探索,Sonnet 5.5 负责快速迭代。其中 Sonnet 5.5 在 Terminal-Bench 4.0 上得分 70.6%(高于 Opus 5.5 的 66.4%),输出速度提升 30%+,定价为 $2 / $10 每百万 token。
同日 Claude 将聊天(chat)与协作(cowork)模式合并为单一模式,对话云端持久化(笔记本开始、手机续接),并新增快捷指令 /docs、/slides、/design。
Docs / Slides / Design 转正
三项工件能力正式脱离 beta,所有套餐(含免费版)可用;官方称用户已生成超 4500 万份文档、演示与设计。本轮还补齐团队协同编辑、管理员管控的外部共享、PowerPoint/PDF 保格式导出、可编辑 Google Slides 导出与移动端编辑。独立 Design 站(claude.ai/design)保留至 12 月 14 日关闭。
两项新 beta 能力
能力 |
用法 |
可用性 |
关键看点 |
Dashboards |
连接 Redshift / BigQuery / ClickHouse / Databricks / Snowflake / Salesforce,自然语言提问生成随数据自动刷新的看板,每个图可查看 SQL 与刷新时间 |
付费套餐 |
直接穿透 chat2sql / 轻量 BI 赛道;可一键送至 Hex、Sigma、Mixpanel 等做深挖 |
Motion |
把文字、图表、形状、图像动画化为短片,以代码驱动而非视频生成模型,可编辑、导出 MP4 |
Team / Enterprise |
每个数字可单独改、源数据变动动画同步更新;可进 Adobe、HeyGen、Runway 精修 |
行业意义:Dashboards 让「自然语言→可审计看板」成为 Claude 默认能力,Motion 用「代码即视频」路线把解释性动画纳入对话流。两者都让 Claude 占据「入口与第一稿」,专业工具退居下游精修——通用助手对垂直工具(BI、动效)的替代压力进一步上升。
四、横向观察:同一周,三条不同的竞争路线
维度 |
谷歌 Gemini Agent |
OpenAI GPT-6 / Sol |
Anthropic Claude 5.5 |
核心叙事 |
企业级通用工作智能体(编排层) |
交互式答案 + 速度商品化 |
对话即生产力套件(文档/看板/动画) |
差异化抓手 |
多模型路由、企业治理、持久记忆 |
Intelligent UI、Ultrafast 速度档 |
工件生态、可审计看板、代码驱动动画 |
商业模式信号 |
实时支出上限、行业专属版 |
速度单独定价(6× 单价 / 8× 额度) |
付费梯度开放新能力(Motion 仅 Team/Enterprise) |
共同方向 |
从文本对话 → 自主执行 + 可视化成品 |
||
三家的更新共同印证:2026 年下半年的大模型竞争,已从「参数与榜单」转向「谁能把任务真正做完、并把结果以可用形态交付」。智能体的持久执行、企业级治理,以及把图表/看板/动画内建于对话,正成为新的主战场。
五、小结
- 谷歌用 Gemini Agent 把通用工作智能体做成了跨应用、跨模型的编排层,并以企业治理与成本上限作为护城河;
- OpenAI以 Intelligent UI 提升交互密度,并以 Ultrafast 把「速度」单独定价,引发「值不值」的付费讨论;
- Anthropic借 Sonnet 5.5 与 Dashboards/Motion 把 Claude 推向 BI 与动效赛道,强化「对话即成品」的定位。


