AI 新闻·2026年9月26日·来源: Testing Catalog
OpenAI 准备向更多用户开放 Ultrafast API
OpenAI 正在准备更广泛地推出其 Ultrafast API 模式,很可能在 9 月 29 日的 DevDay 之后。新模式提供每秒高达 750 个输出 token 的速度,比标准模式快 14 倍。它目前由 Cerebras 技术提供支持,并供选定客户使用。此次扩展可能会引入分级定价,允许开发人员根据工作负载价值选择延迟。OpenAI 与 Cerebras 截至 2028 年的 750 兆瓦合作关系支持此基础设施策略。
Nexa 摘要
OpenAI 的 Ultrafast API 模式与其说是关于原始速度,不如说是关于基础设施控制。GPT-5.6 Sol 每秒 750 个输出 token 的速度令人印象深刻。OpenAI 正在与 Cerebras 更深入地集成,并转向全面的计算层级。这表明未来 API 访问将是细致的,按延迟定价,并与特定的硬件合作伙伴关系挂钩。
对于亚洲的 AI 开发人员来说,这意味着部署模型需要进行新的成本效益计算。新加坡或韩国等市场中专注于高吞吐量应用程序的公司可能会看到显著的效益。然而,经济权衡将至关重要。如果 Ultrafast 模式带有高额溢价,它将限制许多预算较紧的区域初创企业的采用。亚洲开发人员的考验是优化价值,而不仅仅是速度。
值得关注的是 DevDay 上公布的定价结构。如果 Ultrafast 定价具有竞争力,它将加速在亚洲的采用。如果它是一个高成本层级,它将保持小众。OpenAI 与 Cerebras 截至 2028 年的容量部署也值得关注。这将决定 Ultrafast 在最初有限访问之外的扩展速度。
分享这篇文章
深入了解
原文报道: Testing Catalog我们不转载全文, 阅读原文 →






