快速了解本文
OpenAI 正式推出 GPT-6 Astra Ultrafast 服务层级。
API 生成速度最高可达 Standard 模式的 6 倍。
该服务已开放 API 调用,维持高端模型价格区间。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 2026年9月29日,OpenAI 在开发者日(DevDay)上正式推出 Ultrafast 全新服务层级。GPT-6 Astra Ultrafast 在 Codex 中可实现每秒 300 个词元的生成速度,在 API 调用时最高可实现 6 倍于 Standard 模式的生成速度。此前,Ultrafast 模式曾随 GPT-5.6 Sol 预览,由 Cerebras 提供算力支持,输出速度最高达每秒 750 个词元。此次发布打破了以往高速度需牺牲模型能力的妥协,使 GPT-6 级别模型能够胜任对延迟敏感的实时交互场景。
目前,GPT-6 Astra Ultrafast 已开放 API 调用,Pro 500 订阅和企业用户可在 ChatGPT Work 和 Codex 中体验。开发者也可在 Responses API Playground 中选择 Standard、Fast 和 Ultrafast 三种处理速度进行测试。在定价方面,该服务维持了高端模型的价格区间:
功能亮点
短上下文输入:
$60.00/1M tokens
长上下文输入:
$120.00/1M tokens
短上下文输出:
$300.00/1M tokens
长上下文输出:
$450.00/1M tokens
(注:缓存输入和缓存写入另有独立计费标准。)
Ultrafast 的核心价值在于兼顾更强模型与实时响应,官方指出其适合事件响应、实时客服、交易与市场快讯生成、交互式编码等场景。官方同时表示,后续将会跟进推出 GPT-6.1 Sol Ultrafast。
