OpenAI史上最快模型GPT-5.3-Codex-Spark下周退役,7个月生命周期终结
OpenAI宣布其首个逃离英伟达生态的实时编程模型GPT-5.3-Codex-Spark将于下周正式退役。这款每秒生成1200个Token的模型,从发布到下线仅存活7个月,因使用量下降及更优替代品出现...
近日,OpenAI Codex负责人Tibo(Thibault Sottiaux)在社交媒体上宣布,公司史上最快的实时编程模型GPT-5.3-Codex-Spark将于下周正式退役。这款于今年2月12日以研究预览形式推出的实验性模型,从诞生到消亡仅经历了7个月的时间。
根据Tibo的解释,Spark的退役主要基于两个原因:一是该模型的使用量持续下降;二是OpenAI已经开发出更为优秀的替代模型。他在帖子中表示:"是时候给未来腾地方了。"
作为OpenAI首个运行在英伟达GPU之外的生产级模型,GPT-5.3-Codex-Spark采用了Cerebras Systems的晶圆级芯片WSE-3,标志着OpenAI与这家初创公司达成的750兆瓦、总价值超200亿美元算力大单的第一份交付成果。这款模型专为实时编程设计,拥有128k上下文窗口,每秒可生成超过1000个Token,客户端和服务器间的往返开销降低了80%,每个Token的处理成本减少了30%,首Token延迟也缩短了一半。
然而,尽管初期备受关注,Spark的实际应用效果却并不理想。开发者argofowl评论称:"Spark是个好玩的模型,也是个极度糟糕、根本没法用的模型。很高兴它走了,我好几个月没碰过了。"
其他开发者也指出,Spark在实际项目中的表现存在诸多限制。例如,在理解项目上下文或分析日志等基础任务中,其上下文窗口很快就会被填满,迫使用户不得不另开一个对话。更有开发者表示,在几个规模较大的项目中,他们几乎从未使用过Spark。
值得注意的是,真正让一些开发者感到惋惜的,并非模型本身,而是它附带的独立配额。知名开发者Chubby坦言想要一个「GPT-6-Spark」,因为Spark拥有一份不占主额度的独立套餐。在Astra额度极其紧张的当下,很多开发者正是将Spark当作主额度耗尽后的「备用油箱」来顶一阵子。
回顾7个月前的发布时刻,Spark的排场可谓盛大。当时OpenAI将其定位为一款更小、更快、专门服务于实时交互式编程的模型,适用于代码编辑、局部修改和定向测试等场景。开发者Ryan Vogel甚至直接将它编进了正式工作流,与GPT-5.4和GPT-5.3-Codex协同工作,声称这是自己第一次工作流里一个Claude模型都没有,「效率更高,花得更少」。
Instructor作者Jason Liu则直接开了20个Spark子代理去搜文件系统,宣布「RAG已死」。随后不久,他便加入了OpenAI的Codex团队。
然而,Spark的致命伤在于,一块晶圆装不下旗舰模型,它本质上是一个为了极致速度而妥协的「蒸馏版小模型」。在Terminal-Bench 2.0评测中,Spark仅获得58.4%的准确率,远低于完整版GPT-5.3-Codex的77.3%。
Spark的退役标志着OpenAI在探索多样化硬件生态道路上的一次重要尝试结束。尽管承载着摆脱单一硬件依赖的野心,但最终还是败给了「降智提速」的选择。对于整个大模型行业而言,这也预示着一个快速淘汰期的到来,早期实验性模型正在加速退出历史舞台。
随着Spark的谢幕,OpenAI将继续推进其模型迭代进程,而开发者们也将面临新的选择和挑战。