IT之家 9 月 30 日报道,在 2026 年 OpenAI 开发者日的活动中,官方发布了名为 Ultrafast 的全新服务等级。该服务在 Codex 环境中可达到最高 8 倍的词元生成速率,而在 API 调用时则能实现最高 6 倍的生成速度。
在 API 调用费用方面,根据 IT之家从官方渠道查询到的信息,具体定价如下:
| 模型 | 价格类型 | 短上下文(输入 < 272K Token) | 长上下文(输入 > 272K Token) |
|---|---|---|---|
| gpt-6-astra | 输入 | $60.00 / 1M tokens | $120.00 / 1M tokens |
| gpt-6-astra | 缓存输入 | $6.00 / 1M tokens | $12.00 / 1M tokens |
| gpt-6-astra | 缓存写入 | $75.00 / 1M tokens | $150.00 / 1M tokens |
| gpt-6-astra | 输出 | $300.00 / 1M tokens | $450.00 / 1M tokens |
OpenAI 宣布,GPT‑6 Astra Ultrafast 在 Codex 中能够达到每秒 300 个词元的处理速度。目前该服务已开放 API 调用,Pro 500 订阅用户及企业用户可在 ChatGPT Work 和 Codex 中体验。官方表示,后续还将推出 GPT-6.1 Sol Ultrafast。
Ultrafast 的核心价值在于同时实现了“更强模型”与“实时响应”。过去,若要实现接近实时的速度,往往需要切换至更小或更专用的模型;而 Ultrafast 旨在保持 GPT‑5.6 Sol 能力的基础上,提升“每秒有用工作量”,从而更适用于事件响应、实时客服、交易/市场快讯生成、交互式编码等场景。