OpenAI 發布了名為 Ultrafast 的新模型,主打更快的模型響應速度。公司表示,此模式可讓 GPT 5.6 Sol 以標準處理速度的 14 倍運行,輸出速度最高可達每秒 750 個 token,目前先以預覽形式向少量客戶開放。
此更新針對企業對即時 AI 處理的需求。OpenAI 表示,過去若想獲得更接近即時的回應,通常需要改用較小的模型,或選擇針對特定任務優化的系統。Ultrafast 的方向則是在不單純依賴小模型的情況下,提升單位時間內可完成的有效工作量。
輸出速度提升
根據 OpenAI 的說法,Ultrafast 的核心賣點是顯著壓縮生成等待時間。
- 最高輸出速度可達每秒 750 個 token
- 處理速度約為標準模式的 14 倍
- 當前版本仍處於預覽階段
TechCrunch 提到,Anthropic 等競爭對手此前也推出過加速模式。以 Claude 為例,其產品同樣提供快速模式,但 OpenAI 此次公布的速度指標更高。
面向企業工作流
OpenAI 將 Ultrafast 的應用場景指向多類企業任務,重點包括事件響應、客戶服務與支援、金融市場分析以及電商業務等。這類場景通常對延遲更敏感,模型響應時間會直接影響人工協作效率和自動化流程表現。
從產品定位來看,Ultrafast 並非單獨的新模型,而是圍繞 GPT 5.6 Sol 提供的一種高速運行方式。對於企業客戶而言,這意味著在保留較強模型能力的同時,嘗試將 AI 更直接地嵌入實時業務流程。
由 Cerebras 提供支援
OpenAI 表示,Ultrafast 由其與晶片公司 Cerebras 的合作提供支援。首批預覽資格目前僅開放給一小部分客戶,後續會隨著算力容量提升逐步擴大訪問範圍。
這也顯示出,大模型的競爭正從參數與能力的比拼,延伸至響應速度、部署效率和底層算力協同。對於面向企業市場的 AI 產品而言,速度正成為與模型質量並列的關鍵指標。
