据 Google Cloud 官方发布的产品动态汇总,2026 年 1 月至 9 月间,其平台围绕 AI 模型接入、API 治理、数据处理管线和计算基础设施进行了密集更新。
Agent Platform 扩展前沿模型选择
Gemini Enterprise Agent Platform 在此期间引入了多个第三方前沿模型。Anthropic 的 Claude Opus 5、Claude Sonnet 5、Claude Fable 5.1 以及此前的 Opus 4.8 均已上线。其中,Opus 5 兼容零数据保留(ZDR)策略,在渗透测试或漏洞生成等高风险工作流中会通知用户并回退至 Opus 4.8;Fable 5.1 相比 Fable 5 在推理、全生命周期编码和多工具工作流上有所提升。
xAI 的 Grok 4.6 以预览形式加入 Model Garden,支持推理、函数调用和结构化输出,接受文本与图像输入,成为 Grok 系列的旗舰模型。此外,Anthropic 发布了 Enterprise Frontier Safeguards,允许客户在自主控制的云基础设施中存储数据的同时部署高能力模型。
自研模型方面,Gemini 3.1 Pro 已在 Vertex AI 和 Gemini Enterprise 中提供预览版,面向复杂问题求解;Gemini 3.1 Flash-Lite 同步推出预览,针对高并发翻译和内容审核等成本敏感型负载设计,同时能够处理界面生成等需要一定推理深度的任务。
Apigee 向 AI Gateway 演进与 MCP 落地
Apigee 的多项更新集中在将传统 API 管理转化为 AI 代理治理层。Model Context Protocol(MCP)在 Apigee 中正式商用(GA),开发者可通过 OpenAPI 规范将企业 API 直接暴露为 AI 代理可调用的工具,无需部署本地 MCP 服务器。配套的语义搜索功能可在 API Hub 中发现这些工具。
Apigee AI Gateway 提供了统一入口,用于透明代理模型流量、记录实时 Token 消耗并应用运行时安全配额。相关架构指南还展示了如何利用语义缓存优化 Token 成本,以及如何通过 ParsePayload 策略对代理工具调用实施细粒度过滤和执行配额管理。
此外,API Gateway 和 Cloud Endpoints 现已原生支持 OpenAPI v3,允许直接在规范文件中定义遥测、配额和安全策略,不再需要降级至 OASv2。
数据服务与流处理能力升级
BigQuery 连续查询(continuous queries)进入预览阶段,新增有状态处理能力,支持在流式查询中直接使用 JOIN、聚合和窗口函数,例如计算 30 分钟滑动平均值以驱动下游应用。原有的 insertAll 流式 API 已更名为 BigQuery Storage Write API (REST),作为无状态 JSON-over-HTTPS 端点,适用于 Serverless Web 应用和 IoT 遥测场景,现有用户无需更改代码即可平滑过渡;高吞吐场景仍推荐使用 gRPC 版本。
Dataflow 批处理作业的“失败暂停”(pause-on-failure)功能正式商用,可在作业失败前保留状态,处理外部问题后恢复执行而不丢失已完成的工作。管道更新新增了停止并替换(stop-and-replace)模式,并可设置排空超时以防止卡死处理导致成本失控。
Managed Service for Apache Kafka 的 PostgreSQL 源连接器正式商用,支持从 Cloud SQL for Postgres、AlloyDB 及自建 PostgreSQL 低延迟捕获变更数据。该托管服务还上线了合成数据生成器工具,可在数分钟内向集群发送模拟数据用于测试。
SAP Business Data Cloud (BDC) Connect for BigQuery 宣布商用,实现 SAP 系统与 BigQuery 之间的零拷贝双向数据共享。Cortex Framework 7 同步商用,提供面向 SAP 数据的数据产品加速器,并与 BigQuery、Dataform、Knowledge Catalog 等产品集成。
计算、存储与开发者工具
Compute Engine 为 G2(NVIDIA L4)和 G4(NVIDIA RTX Pro 6000)GPU 虚拟机推出了 Flexible Committed Use Discounts (Flex CUDs),允许在单一支出承诺下跨 VM 系列、区域及服务组合使用。G4 分数化虚拟机正式商用,基于 NVIDIA vGPU 技术提供 1/2、1/4 和 1/8 GPU 切片选项。
Cloud Run 沙盒进入公开预览,可在现有服务实例内快速启动隔离执行环境,用于运行 LLM 动态生成的代码或无头浏览器任务。Cloud Run Worker Pools 正式商用,专为拉取式非 HTTP 后台任务设计;开源的 CREMA 自动扩缩器基于 KEDA,可根据 Pub/Sub 积压量等外部信号进行队列感知扩缩。Service Health 功能也已商用,通过就绪探针实现跨区域自动故障转移。
在 AI 训练基础设施方面,GCSFS 2026.8.0 版本将自适应并发预取设为默认行为,单文件吞吐量可提升 5 倍,配合 Rapid Bucket 最高可达 21 GiB/s。Run:ai Model Streamer 原生支持 TPU,在基准测试中将 480B 参数模型的加载速度提升逾 2 倍,同时将主机内存峰值占用减半。新的 AI Telemetry Collector 代理基于 OpenTelemetry 标准化 TPU 监控,可将指标路由至 Cloud Monitoring 或 Prometheus。
其他更新包括:Firestore Enterprise 版引入包含百余项新特性的管道操作查询引擎;VM Extension Manager 正式商用,支持声明式管理 Compute Engine 机群的客户机软件生命周期;AlloyDB Omni Red Hat RPM 编排器正式商用;Cloud Location Finder 正式商用,可跨 Google Cloud、AWS、Azure 和 OCI 发现区域信息。控制台深色模式也已全面上线。
