模型
费城儿童医院用开源 AI 在数秒内生成儿童心脏模型
费城儿童医院基于 MONAI 等开源框架,将儿童心脏三维建模从数小时压缩至数秒,并引入 Newton 物理引擎实现近实时的器械部署模拟。目前全美已有超过 20 家儿童医院运行类似的心脏建模项目。

正在加载内容…
模型发布、能力与研究进展
按专题关键词整理已发布事件,最多显示 300 条。
模型
费城儿童医院基于 MONAI 等开源框架,将儿童心脏三维建模从数小时压缩至数秒,并引入 Newton 物理引擎实现近实时的器械部署模拟。目前全美已有超过 20 家儿童医院运行类似的心脏建模项目。

模型
据 Google AI 介绍,其技术与产品目前支持超过300种语言的日常交互,覆盖全球86%人口。Gemini 3.5 Live Translate 可在70种语言间进行实时语音翻译,TranslateGemma 则让高质量翻译能够在无网络环境下于设备端运行。

Agent
Google 为 Gemini Notebook 推出新版界面及多项学习功能,包括移动端实时语音对话、音频录制、交互式学习概览、短视频概览,以及面向大学生的免费 AI Pro/Plus 订阅。

模型
Google Research 在 ICML 2026 提出 Retrieve-for-Train 框架,通过离线强化学习将集合级检索目标编译为监督信号,并蒸馏至轻量扩散模型,实现单次非自回归查询展开,推理速度提升 12 至 20 倍。

Agent
据 Google 介绍,用户可通过 Gemini 的图像识别与对话功能处理家庭维修、餐饮规划、开支记录和大件采购等日常事务。其研究显示,超过 86% 的对话式 AI 交互发生在工作场景之外。

模型
Google 在 Gemini API 和 AI Studio 中推出 Gemini 3.8 Live、3.8 Live Extended Thinking 及 Gemini 3.5 Transcribe 模型,支持异步函数调用、视觉上下文和多语言对话,并公布相应定价。

Agent
由全球 Google 开发者社区(GDG)主办的 DevFest 2026 定于 10 月 1 日至 12 月 31 日举行,预计覆盖 115 个国家的 800 多场活动,重点围绕 Gemini、Firebase、Flutter 等工具展开实操演练。
模型
Google 推出 Google Gen AI SDK for Kotlin 1.0 正式版,基于 Kotlin Multiplatform 构建,为 JVM 后端开发者提供协程流式响应、多模态分析、图像生成及 Gemini Live 实时交互等能力。
模型
Google Cloud 对比了 Gemma 3 12B 与 27B 模型在 TPU v6e 上的推理表现。结果显示,高并发生成任务中 12B 模型扩展性显著优于 27B,而在预填充密集的分类任务中两者吞吐量接近。
模型
据Google威胁情报小组(GTIG)2026年9月发布的报告,攻击者在2026年第二季度已从基础提示词交互升级为多代理自动化工作流,将大规模凭证窃取等行动的耗时压缩至数小时。同时,针对开源软件供应链、专有AI知识产权及企业云算力的攻击显著增加。
模型
Google Research 提出 ME-POIs 框架,将聚合匿名移动模式与文本描述融合,为语言模型构建兼具静态身份与动态功能的地点嵌入。在未见地点的多项预测任务中,该框架相较纯文本基线带来最高 81.9% 的相对提升。
模型
Google Research 在 CHI 2026 发表 AgentHands,将大语言模型的输出转化为与语音同步的三维手势,使 AI 助手能在扩展现实环境中通过物理动作指导用户完成操作。
模型
NVIDIA 已同意以 129.3 亿美元收购开源 AI 平台 Hugging Face。交易完成后,Hugging Face 将继续作为开放平台运营,支持多模型、多云与多加速器生态,无需依赖 NVIDIA 计算硬件。
模型
Gartner 发布首份 2026 年企业 AI 助手魔力象限报告,Google 凭借 Gemini Enterprise 在愿景完整性和执行能力两项评估中均进入领导者象限。
模型
Google DeepMind 推出 AlphaGenome Atlas,利用 AI 模型预先计算人类基因组中约 90 亿种单字母基因变化的调控影响,生成 1PB 数据集,并通过 AVI 评分帮助研究人员快速筛选关键变异。
模型
TimesFM-3 拥有 3.3 亿参数,在超过 1 万亿个时间点的数据上预训练,首次原生支持多目标、历史协变量及过去-未来协变量的联合预测,并在多项公开基准中取得领先。
模型
Google 计划未来两年在芬兰投入 130 亿欧元,用于数字基础设施、清洁能源项目和经济合作,以满足搜索、地图和 Gemini 等核心服务日益增长的需求。这是该公司在欧洲最大的一笔单项投资。
模型
据 Google Cloud 官方博客汇总,2026 年初至 9 月期间,Gemini Enterprise Agent Platform 陆续上线 Anthropic Claude、xAI Grok 及自研 Gemini 3.1 系列等多款模型。同期,Apigee AI Gateway 与 MCP 协议正式商用,BigQuery、Dataflow、Cloud Run 等核心服务在流处理、批作业容错和无服务器计算方面完成多项功能升级。
模型
Google Research 联合 NASA JPL 发布 MAPL-EMIT 框架,基于视觉 Transformer 架构处理 EMIT 高光谱卫星数据,可在全球范围内自动检测、量化并定位甲烷羽流。该模型在专家标注数据集上达到 84% 召回率,相关数据库与工具已开源。
模型
由奥斯卡提名导演 Liz Garbus 执导的短片《Love, Rendered》记录了结婚逾七十年的 Burt 与 Ethelle Shatz 夫妇,在 Burt 认知衰退的背景下,借助 Google DeepMind 的图像修复与动作捕捉模型,逐帧重建两人从未被影像记录的初遇场景。
模型
Google DeepMind 联合多家机构,在密码学安全环境中对 Gemini Flash Lite 模型进行双盲基准测试,防止模型提前接触测试内容。
模型
Google 与 NASA JPL 在 PNAS 发表研究,推出 AI 模型 MAPL-EMIT,利用 NASA EMIT 仪器从太空追踪全球甲烷羽流,检测数量较人类专家提升 50%。相关数据库与工具已在 Earth Engine、Kaggle 和 GitHub 开放。
模型
据NVIDIA AI Blog介绍,当前主要商业化Robotaxi项目均在使用NVIDIA提供的训练、仿真与车载计算平台。该平台覆盖从模型训练到实车部署的完整开发周期,Uber、Waymo、特斯拉等出行服务商、自动驾驶开发商及车企已在亚洲、欧洲、中东和北美采用这一架构。
模型
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 引入智能体视频理解功能,通过动态检索替代固定帧率处理,可将长视频分析成本降低最高 66%、Token 消耗减少最高 88%,同时准确率提升最高 7%。该功能已通过 API 上线,并将陆续进入 Gemini 应用与 YouTube。
模型
Gemini 3.8 Flash 在软件工程、智能体任务和多步推理上较前代显著提升,同时推出面向可信防御者的网络安全版本 3.8 Flash Cyber。
Agent
Google 推出面向 Windows 10 和 11 的 Gemini 桌面应用,支持快捷键唤起、多步骤任务代理及图像视频生成,即日起全球上线。
模型
Google Cloud CEO Thomas Kurian 在高盛科技大会上介绍了全栈 AI 策略、AI 基础设施回报周期以及 Gemini Enterprise 的采用情况。
模型
Google Research 在 ACL 2026 发表 ToolGrad,提出先生成工具调用链再标注用户提示的范式。该方法利用文本梯度迭代构建 API 工作流,以更低成本生成更复杂的工具调用数据,微调后的 Gemma-3-12B 模型在 BFCL 基准上可匹敌甚至超越部分头部闭源模型。
模型
Google DeepMind 发布 Fairwind 计划,向政府机构、关键基础设施运营商等受信任合作伙伴提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具,用于自主发现并修复安全漏洞。
模型
Skild AI 推出 S1 机器人基础模型,通过上下文学习技术,使机器人无需重新训练权重即可从单段演示视频中理解并执行未见过的长序列任务。该模型基于 NVIDIA AI 基础设施开发,已在制造、物流等领域建立超过 60 个部署合作。
模型
据发布方称,Google DeepMind 推出 AlphaGenome Atlas 平台,包含人类基因组中全部 90 亿个单核苷酸变异的预测效应。该平台数据集大小为 1PB,并提供整合 AlphaGenome 与 AlphaMissense 模型结果的 AVI 评分。
模型
Google DeepMind 与 Google Research 推出 WeatherNext 3,该模型直接学习实时卫星观测数据,以最高5公里空间分辨率和每小时频率生成全球天气预报。据 Brightband 独立评估,这是目前最先进且准确的全球天气模型。新模型已集成至 Google 搜索、地图等核心产品。