模型
Google Cloud 推出 Distributed GraphFlow,支持电信网络图神经网络规模化运行
Google Cloud 发布开源 Python 库 Distributed GraphFlow(DGF),结合 Spanner Graph 数字孪生与 AI Agent,帮助电信运营商在大规模时序关系数据上运行图神经网络,实现异常检测、根因分析等自主网络运维能力。

正在加载内容…
智能体产品与应用进展
按专题关键词整理已发布事件,最多显示 300 条。
模型
Google Cloud 发布开源 Python 库 Distributed GraphFlow(DGF),结合 Spanner Graph 数字孪生与 AI Agent,帮助电信运营商在大规模时序关系数据上运行图神经网络,实现异常检测、根因分析等自主网络运维能力。

模型
NVIDIA 在 AI Infra Summit 上发布多项合作与性能数据,涵盖电网灵活负载、DSX MaxLPS 功耗优化、Groq 3 LPX 推理加速以及 AgentX 基准测试结果,核心指标正从峰值性能转向每兆瓦生成的有效 Token 数。

Agent
Google Cloud 发布 Filestore agent volumes,这是一项专为 AI Agent 工作区设计的全托管弹性文件存储能力,可与 GKE 上的 Agent Substrate 配合,实现毫秒级自动挂载、严格隔离及按量付费。

模型
Google Cloud 宣布开源项目 Agent Substrate 在 GKE 可用。该运行时专为自主 Agent 设计,可在单主机上以 10 倍于标准容器的密度运行沙箱,并在 500 毫秒内完成挂起与恢复。Nous Research 已将其用于构建全球使用量排名第一的 Hermes Agent。

模型
Google Cloud 为 BigQuery 新增六项增强分析表值函数(TVF),涵盖归因、因果推断、相关性检测等能力。这些函数可直接在数据所在环境运行并输出结构化 SQL 结果,已被集成至 Conversational Analytics,供 AI Agent 以自然语言编排多步分析流程。
Agent
由全球 Google 开发者社区(GDG)主办的 DevFest 2026 定于 10 月 1 日至 12 月 31 日举行,预计覆盖 115 个国家的 800 多场活动,重点围绕 Gemini、Firebase、Flutter 等工具展开实操演练。
模型
根据 NVIDIA 基于 SemiAnalysis AgentX 工作负载的早期测量数据,Vera Rubin NVL72 在代理式 AI 推理中每兆瓦吞吐量可达 GB300 NVL72 的 30 倍,每百万 token 成本降低至多 35 倍。
模型
NVIDIA 宣布 Groq 3 LPX 机架级系统进入全面量产,在长上下文基准测试中实现每秒 3,400 个输出 token。同时,Spectrum-X Multiplane、Scale-In 网络架构及 NVLink Fusion 同步更新,多家合作伙伴已开始采用 Vera Rubin 平台。
模型
日本电信运营商 KDDI 开发了基于 RAG 的消费级 AI 应用 Buffmee,通过自动化评估框架与 Agent Development Kit 优化,将总响应延迟降低 38%,首字时间改善近 18%。
模型
Biomarker Discovery Framework 将候选生物标志物的优先级排序构建为受人类监督的迭代研究循环,在三个队列、9279 个参与者观测中识别出 66 项候选数字生物标志物。
模型
Google Cloud 发布 Antigravity SDK,将 Antigravity 2.0 的运行时引擎、声明式安全策略、实时遥测和有状态多轮持久化能力引入开发者自建的多智能体控制平面。
模型
Google Research 在 CHI 2026 发表 AgentHands,将大语言模型的输出转化为与语音同步的三维手势,使 AI 助手能在扩展现实环境中通过物理动作指导用户完成操作。
模型
据 Google Cloud 官方博客汇总,2026 年初至 9 月期间,Gemini Enterprise Agent Platform 陆续上线 Anthropic Claude、xAI Grok 及自研 Gemini 3.1 系列等多款模型。同期,Apigee AI Gateway 与 MCP 协议正式商用,BigQuery、Dataflow、Cloud Run 等核心服务在流处理、批作业容错和无服务器计算方面完成多项功能升级。
模型
Google Cloud 发布基于开放标准的 Agent Plugin,将技能与 MCP 服务器打包为可安装单元,帮助 AI 编程代理更高效地完成身份验证、项目管理和文档检索等 Google Cloud 操作。
模型
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 引入智能体视频理解功能,通过动态检索替代固定帧率处理,可将长视频分析成本降低最高 66%、Token 消耗减少最高 88%,同时准确率提升最高 7%。该功能已通过 API 上线,并将陆续进入 Gemini 应用与 YouTube。
模型
Gemini 3.8 Flash 在软件工程、智能体任务和多步推理上较前代显著提升,同时推出面向可信防御者的网络安全版本 3.8 Flash Cyber。