AI 新聞·2026年9月26日·來源: Testing Catalog
OpenAI 準備向更多用戶開放 Ultrafast API
OpenAI 準備更廣泛地推出其 Ultrafast API 模式,很可能在 9 月 29 日的 DevDay 之後。新模式提供每秒高達 750 個輸出 token 的速度,比標準模式快 14 倍。它目前由 Cerebras 技術提供支援,並供選定客戶使用。此次擴展可能會引入分級定價,讓開發人員根據工作負載價值選擇延遲。OpenAI 與 Cerebras 截至 2028 年的 750 兆瓦合作關係支援此基礎設施策略。
Nexa 摘要
OpenAI 的 Ultrafast API 模式與其說是關於原始速度,不如說是關於基礎設施控制。GPT-5.6 Sol 每秒 750 個輸出 token 的速度令人印象深刻。OpenAI 正在與 Cerebras 更深入地整合,並轉向全面的運算層級。這表明未來 API 存取將是細緻的,按延遲定價,並與特定的硬件合作夥伴關係掛鉤。
對於亞洲的 AI 開發人員來說,這意味著部署模型需要進行新的成本效益計算。新加坡或韓國等市場中專注於高吞吐量應用程式的公司可能會看到顯著的效益。然而,經濟權衡將至關重要。如果 Ultrafast 模式帶有高額溢價,它將限制許多預算較緊的區域初創企業的採用。亞洲開發人員的考驗是優化價值,而不僅僅是速度。
值得關注的是 DevDay 上公佈的定價結構。如果 Ultrafast 定價具有競爭力,它將加速在亞洲的採用。如果它是一個高成本層級,它將保持小眾。OpenAI 與 Cerebras 截至 2028 年的容量部署也值得關注。這將決定 Ultrafast 在最初有限存取之外的擴展速度。
分享這篇文章
延伸閱讀
原文報道: Testing Catalog我們不轉載全文, 閱讀原文 →






