Google Cloud 推出 Gemini agent:面向企业工作的统一智能体
Google Cloud 发布 Gemini agent,定位为面向企业工作的统一智能体,可从单一提示框和单一 API 完成问答、知识工作、媒体生成与代码编写运行。官方称其支持多模型编排、持久记忆与治理机制,但尚未公布基准测试、价格与正式可用时间。
核心事实
据 MarkTechPost 报道,Google Cloud 在 Gemini at Work 活动上发布了 Google Cloud Gemini agent,将其描述为面向企业工作的单一通用智能体。该智能体托管在 Google Cloud 上,可回答问题、完成知识工作、生成媒体,以及编写并运行代码,全部通过一个提示框和一个 API 完成。对开发者而言,报道称其定位是「智能体即产品,模型只是路由决策」。
报道称,该智能体可从网页、移动端、桌面端、CLI、Workspace、Microsoft 365、Slack 或无头方式访问。Google 列出六项架构原则:统一智能体、随处可及、持久执行、多智能体编排、深度上下文,以及模型选择灵活性。它维护会话、语义、程序性和情景四类记忆,并通过企业工具注册表与连接器接入 Slack、Jira、Salesforce、ServiceNow、BigQuery、Snowflake 等系统。
背景与影响
报道称,该智能体目前可跨 Google 的 Gemini 系列模型与 Anthropic 的 Claude 模型进行编排,并计划支持其他私有与开源模型。Google 自有阵容包括用于前沿推理的 Argon、面向速度与吞吐的 Flash、用于生成式媒体的 Omni,以及面向开放权重边缘场景的 Gemma。
在治理方面,Google 从身份、授权、审计与策略四个维度设计:每个智能体获得经加密证明的身份与最小权限,操作记录归属智能体而非个人,所有流量经过 Agent Gateway。成本控制方面,报道提到多模型编排、Smart Routing 与实时支出上限,团队可在 Cloud Billing Console 设置项目硬性限额,触发后该项目智能体暂停直至有人恢复。报道还称 Google 团队表示其 TPU 8i 系统相比上一代提供 80% 更好的性价比。
限制与来源
需要说明的是,上述内容来自 MarkTechPost 的报道,其中部分表述为 Google 方面的说法。报道明确指出,目前尚无基准测试数据、价格信息或正式可用(GA)日期。文中提到的 Bloomberg Media 将 SQL 查询准确率提升 63% 属于客户案例陈述,报道本身也提示买家应基于可复现数据而非客户轶事来评估。功能范围、地区可用性、账号与语言支持等,请以 Google Cloud 官网当前信息为准。
来源:MarkTechPost,链接:www.marktechpost.com