OpenAI正在加速淘汰早期模型。近日,OpenAI Codex負責人Tibo (蒂博?索蒂奧,Thibault Sottiaux)宣布,GPT-5.3-Codex-Spark將在下周退役。
這款今年2月發(fā)布的實驗性編程模型,生命周期不足八個月,也成為OpenAI探索Cerebras晶圓級芯片推理路線后首個被淘汰的模型。
GPT-5.3-Codex-Spark于2月12日以研究預覽形式推出,定位明確:它是一款更小、更快、專門服務(wù)于實時交互式編程的模型,適用于代碼編輯、局部修改和定向測試等場景。
Spark最特殊之處并非速度,而是運行它的硬件。它采用Cerebras WSE-3晶圓級處理器,是OpenAI首次將生產(chǎn)環(huán)境中的模型推理部署到英偉達GPU之外的芯片平臺。
Cerebras將大量計算單元和片上SRAM(靜態(tài)隨機存儲器)集成在整張晶圓上,減少傳統(tǒng)GPU系統(tǒng)中模型權(quán)重在計算芯片與外部內(nèi)存之間反復搬運帶來的延遲,因此尤其適合低延遲推理。
這一嘗試發(fā)生在OpenAI擴大算力供應(yīng)商范圍的背景下。2026年1月,OpenAI宣布與Cerebras達成多年合作,將部署最多750MW(兆瓦)的Cerebras推理算力。Cerebras隨后披露的金額超過200億美元,算力將在2028年前分階段上線。因此,該合作也被視為OpenAI降低對單一GPU供應(yīng)體系依賴、建立多元算力組合的一次嘗試。
但速度優(yōu)勢并未轉(zhuǎn)化為用戶留存。Spark定位為輕量化實時編程分支,僅向ChatGPT Pro用戶開放,用于Codex客戶端、CLI命令行和VS Code插件場景。開發(fā)者反饋兩極分化:有人認為它在重構(gòu)等機械性任務(wù)上“速度非常快”,也有開發(fā)者稱“Spark是個好玩的模型,也是個極度糟糕、根本沒法用的模型”。
缺點迅速被新模型填補。8月,OpenAI發(fā)布GPT-5.6 SolUltrafast模式,同樣由Cerebras提供底層推理能力,輸出速度最高達到750 token/s。與Spark不同,Ultrafast運行的是完整的GPT-5.6 Sol,而不是為了速度專門壓縮的小模型。
Spark發(fā)布時,當時的技術(shù)與工程能力僅能支持實時編程在模型能力和響應(yīng)速度之間取舍。而到了GPT-5.6 Sol Ultrafast,OpenAI試圖同時獲得兩者。Cerebras也將這一變化概括為過去AI產(chǎn)品長期存在的“速度與智能二選一”正在被打破。
Spark因此失去了繼續(xù)獨立存在的必要性。對于一個使用范圍較窄、需要單獨適配和運營的實驗性模型而言,如果更強的主力模型已經(jīng)能夠在同一硬件平臺上提供足夠快的響應(yīng),繼續(xù)維護舊模型的產(chǎn)品價值自然下降。
這也意味著模型行業(yè)進入快速淘汰期。過去,大模型迭代往往以半年甚至數(shù)年的版本周期為主;如今,模型產(chǎn)品越來越接近互聯(lián)網(wǎng)軟件的持續(xù)實驗?zāi)J剑合柔槍μ囟▓鼍巴瞥鲆粋€模型,驗證速度、成本和用戶需求,再把成功的技術(shù)路線遷移到下一代主力模型,最后迅速淘汰舊版本。