专属端点与类型化答案输出
2026年10月6日,OpenAI在其API更新日志中宣布正式推出Decisions API的公开Beta版本。与传统的对话或文本生成端点不同,该接口采用了专用的POST /v1/decisions端点,且现阶段仅专门支持gpt-6-luna模型。
在输入与请求结构方面,Decisions API支持多模态输入,允许开发者提供纯文本字符串或包含文本与图像的用户消息作为共享证据(Shared evidence)。请求体主要由三部分构成:模型名称(model)、输入证据(input)以及待评估的问题列表(questions),其中问题列表中需详细指定问题类型、操作指令和允许的候选选项。
该接口返回三种格式的类型化答案(typed answers):其一是返回0到1之间概率估值的条件判断(predicate);其二是从无序选项中给出一个值的单选(choice);其三是基于有序级别索引计算概率加权平均值的评分(score)。
官方性能宣称与应用场景定位
OpenAI官方主张,Decisions API将文本和图像转化为类型化答案的速度相比Responses API提升了10倍。在此前的2026年9月下旬DevDay 2026活动期间,OpenAI曾对外宣称该API的单次请求延迟约为150毫秒。
针对应用场景,OpenAI推荐将Decisions API用于内容分类、请求路由或工作优先级排序,例如快速判定AI代理(AI Agent)的下一步执行动作。不过官方同时指出,若开发者需要生成遵循特定模式的完整JSON对象,则应继续使用Responses API的结构化输出(Structured Outputs)功能。Responses API是OpenAI此前推出的统一接口,用于替代Chat Completions以构建具备内置工具和多轮状态交互的代理系统。
底层模型规格与行业竞争态势
Decisions API当前独占支持的GPT-6 Luna模型于2026年9月22日发布,具备105万(1,050,000)个token的上下文窗口与12.8万(128,000)个token的最大输出能力,其知识截止日期为2026年5月18日。该模型标准API定价为输入每百万token 0.10美元、缓存输入每百万token 0.01美元、输出每百万token 0.50美元,价格较前代GPT-5.6 Luna降低了约50%。
行业媒体与分析人士普遍将Decisions API视为OpenAI针对TypeSafe旗下高速AI产品Jev的直接竞争动作,两款产品均基于预定义有限选项机制进行判断。媒体分析认为,Decisions API的核心逻辑在于将大语言模型的能力从开放式生成收窄为有限选项选择,从而在代理工作流的微小分支决策中实现极低延迟。
第三方实测表现与落地考量
在独立第三方的早期实测中,开发者eesel AI于2026年10月初公布了测试数据:在160次工单路由测试中,Decisions API的队列选择准确率达到100%,但其实测响应时间中位数为1.46秒,与官方宣称的数百毫秒级极速水平存在差距。
eesel AI的测试分析指出,虽然Decisions API在工单队列选择等明确分类判断上表现优异,但在处理需要更高确定性的复杂判断时,现有系统仍需要保留人工介入机制作为后备方案。

