核心跃迁:从“单次问答工具”走向“持续协同智能体”
2026年9月29日,OpenAI 于美国旧金山举行了年度开发者大会 DevDay 2026。在本次大会上,OpenAI 集中展示了超过20项新功能与系统更新。与以往聚焦于模型基础参数提升与单项基准测试不同,官方 Recap 明确指出,本次大会的核心主题标志着 AI 正式跨越了以即时对话为核心的技术阶段,开始从单纯“回答问题的工具”全面演化为能够“持续协同工作的智能体”。这一战略基调的确立,不仅反映了底层大语言模型能力的成熟,更揭示了开发范式与产业需求层面的深刻转变。
在传统的“提示-响应(Prompt-Response)”机制下,AI 系统始终处于被动触发状态:用户提出具体问题,模型生成文本,单次交互即告终止。这种交互模式将大量的认知负荷和流程整合成本转嫁给了人类,用户必须持续维持上下文、反复校验指令并在多个软件之间手动穿梭。媒体分析指出,以 DevDay 2026 发布的常驻智能体 dots 为标志,AI 的交互模式正发生根本性转向——从单次提示响应转为承担持续责任。这一转变意味着 AI 不再只是待命的代码生成器,而是被赋予了持久化执行复杂业务工作流的能力与边界。
运行环境解绑:Codex Cloud 与常驻智能体的云端底座
长期以来,智能体在真实软件工程中的落地面临严峻的运行环境制约。当代码生成与测试完全依赖开发者的本地计算机时,长耗时任务不仅严重占用本地计算资源,更受到网络断联、终端休眠及本地环境配置差异的干扰。为此,OpenAI 正式推出了 Codex Cloud,构建了一个允许开发者在 OpenAI 托管的云端计算机上直接运行编码任务的完整云环境。该架构打破了物理终端的束缚,实现了任务在桌面端、命令行工具(CLI)、移动端和网页端之间的无缝流转与衔接。
在底层技术实现上,Codex Cloud 任务运行于基于 ubuntu:24.04 的 codex-universal 标准 Docker 镜像容器中。这种标准化的容器化设计为开发者提供了可预测、可隔离且高复现性的依赖管理底座。在用户权限分配上,该服务覆盖了 Plus、Pro、Business、Healthcare、Education 以及 Enterprise 等付费与企业级订阅账户,而免费版 Free/Go 用户则不在支持范围内。这一商业策略清晰地表明,OpenAI 正在将云端执行环境作为专业与企业生产力阶梯的核心护城河。
与面向开发者代码工作流的 Codex Cloud 相呼应,OpenAI 针对泛业务场景推出了名为 dots 的常驻 AI 智能体。由旗舰级 GPT-6 Astra 驱动的 dots 拥有独立的云端计算机与浏览器环境,并通过插件生态连接超过4000个外部应用程序。dots 能够在后台保持24/7连续运行,横跨各类企业协作平台维系全局业务上下文,并在关键决策节点向人类提出确认。Codex Cloud 与 dots 的协同推出,实质上构成了 OpenAI“云端常驻算力底座”的完整拼图:前者针对研发环境实施容器化解绑,后者则为企业常态业务赋予了持久运行的数字劳动力实体。
交互与调度重塑:Codex CLI 的多 Agent 并行化演进
随着任务执行环境向云端迁移,开发者面对的不再是单一代码段的生成请求,而是多个并行运转的异步长周期任务。原有的终端界面在应对这种高密度、长时间跨度的信息流时显露出明显的局限性。在此背景下,Codex CLI 迎来重大重构,推出了支持滚动历史加载的全新全屏界面。旧的会话历史记录突破了传统终端的回溯限制,在滚动时自动加载;同时输入区域(Composer)被固定在屏幕特定位置,确保开发者在检视长文本会话日志时能够随时输入新指令。
比界面改造更为关键的是调度控制能力的引入。新版 Codex CLI 专门增加了针对并行智能体工作流的控制命令:开发者可以使用 /agents 命令实时查看当前所有正在运行的任务概况、检查其执行进度,并在不同的任务之间快速跳转;而通过 /fork 命令,开发者能够将当前正在进行的对话即时分支至一个具备相同上下文但完全独立的检出工作树中,从而能够免除干扰地探索不同的实现方案。此外,CLI 还集成了 /voice 语音指令,丰富了多模态输入的调度手段。
这些调度命令的本质,是将现代软件工程中的“版本控制与并发分支”理念直接引入到人与智能体的交互协议之中。过去,与 AI 的对话呈现为绝对线性的时序链条,单点失败或尝试性探索往往污染既有上下文;而 /fork 与 /agents 的组合,使开发者能够像管理 Git 分支和微服务一样对多个探索性 Agent 实施调度。这标志着开发者的角色正由逐行编写代码的操作者,快速向管理由多个 AI Agent 组成的“虚拟工程团队”的架构师与督导者演变。
算力经济学重组:GPT-6.1 Sol 的定位与工程取舍
在智能体走向常态化、多实例并发运行的新阶段,推理成本直接构成了企业规模化落地的核心经济瓶颈。若完全使用旗舰模型驱动后台海量轮次的试错与工具调用,API 消耗将难以承受。为此,OpenAI 正式发布了中端模型 GPT-6.1 Sol。该模型在产品矩阵中精准定位于旗舰级 GPT-6 Astra 之下、轻量级 GPT-6 Luna 之上,官方宣称其在代码编写、计算机操作及专业业务分析等关键任务中,展现出了接近旗舰级 Astra 的智能水准。
在成本设计上,GPT-6.1 Sol 展现出极其鲜明的进攻性:其标准 API 定价设定为每100万输入 token 2.00美元、每100万输出 token 10.00美元,仅为旗舰 Astra 成本的五分之一;更为关键的是,其缓存输入 token 的单价进一步降低至每100万 token 0.10美元。与这一低廉价格形成鲜明对比的是其强大的吞吐容量——GPT-6.1 Sol 配备了高达 1,050,000 tokens 的超长上下文窗口以及 128,000 tokens 的最大输出限制。这一组合表明,该模型专为需要吞吐海量上下文及代码库、同时对运行成本高度敏感的 Agent 复杂任务量身定制。
然而,高性价比并非无代价的技术魔法,而是基于明确工程取舍的结果。官方技术规格显示,GPT-6.1 Sol 不支持最小化推理工作量(minimal reasoning effort)模式,并且在 Chat Completions 接口中不提供原生工具调用(tool calling)支持。这意味着在工程落地中,开发者若试图利用传统的 Chat 模式编排工具,将面临接口协议上的约束。这种设计取向清晰地传递出模型特化的信号:Sol 被深度绑定在特定的高级 Agent 运行时与特定推理架构中,通过剥离部分传统接口的宽泛特性,换取了极限的成本效益与推理表现。
速度与价格的分层极致:Astra Ultrafast 的服务层逻辑
与追求极致成本效益的 GPT-6.1 Sol 处于光谱另一端的,是对极致交互延迟的探索。OpenAI 在本次大会推出了 Astra Ultrafast。需要明确的是,Astra Ultrafast 并非一款全新架构的独立模型,而是 OpenAI API 中速度最快的专属服务层级(Service Tier)。开发者在发起 API 请求时,必须将模型明确指定为旗舰级 GPT-6 Astra,并将 service_tier 参数设置为 ultrafast,方能激活该通道。
在该模式下,底层的硬件底座扮演了核心角色。在 NVIDIA Blackwell GPU 的算力支持下,Astra Ultrafast 在通用 API 调用中实现了最高6倍的 token 生成速度提升,在 Codex 场景中其速度提升更是达到最高8倍,峰值生成速率达到每秒 300 tokens。这一吞吐速率彻底重塑了长代码生成与复杂推理过程的等待体验,使得人机协同在感官上几乎消除了延迟滞后,逼近即时交互的物理极限。
速度的极度跃升直接伴随着高昂的计算溢价。GPT-6 Astra Ultrafast 梯度的定价达到了标准 Astra 模型的6倍,具体收费高达每100万输入 token 60美元、每100万输出 token 300美元。这种6倍于基准价格的激进收费标准,反映出专用高性能硬件资源(如 Blackwell 集群)的供需成本。这一价格分化向行业展示了清晰的场景隔离:高频、前台、依赖人类即时注意力和强反馈循环的任务将采用 Ultrafast;而耗时漫长、后台自主轮询的代码测试与多智能体博弈,则必然流向如 Sol 这样的低成本经济层级。
系统性闭环与行业重构:从模型供应商到自主生产力操作系统
将 DevDay 2026 的多项发布组合审视,便能清晰看到一个完整的生产力操作系统闭环:GPT-6.1 Sol 提供了经济可行的规模化推理底座;Astra Ultrafast 依托 Blackwell 硬件解决了高要求场景下的交互延迟瓶颈;Codex Cloud 与 dots 提供了脱离本地依赖的 24/7 持久化云端运行时容器;而全新的 Codex CLI 则充当了人类组织、分支和管理并行 Agent 的控制中枢。这些发布之间不是零散的产品迭代,而是共同服务于“智能体自主持久协同”这一宏大主线。
这一闭环的形成标志着 OpenAI 正在经历深刻的商业与技术定位重塑:它正试图从提供原始模型权重的底层 API 供应商,升级为直接托管数字劳动力及其执行环境的基础设施运营商。在此体系下,开发者购买的不再仅仅是 token 的输入输出,而是购买云端沙箱环境(Ubuntu 容器与云 PC)、算力优先级(标准层与 Ultrafast 极速层)以及并行协作的调度权。这种转变大幅度推高了平台粘性,使得第三方的代码与业务流程更深地绑定在这一综合运行体系之中。
在看到体系化突破的同时,也必须客观看待这一新兴范式面临的技术约束与现实边界。GPT-6.1 Sol 砍掉部分原生工具调用的做法展现了模型特化的摩擦,Astra Ultrafast 极其昂贵的倍数定价对广大中小型开发者的预算构成了直接考验,而云端容器与常驻智能体在跨组织企业落地时更面临数据边界与运维可控性的审慎评估。从单次问答到持续协同智能体的道路已经清晰展开,但整个软件行业如何在算力成本、架构特化与自主权限之间取得平衡,仍将是未来数年内持续演进的核心议题。

