OpenAI公开了其专用编码AI代理最新版本GPT-5.3-Codex的轻量版"GPT-5.3-Codex-Spark"。通过此次发布,OpenAI采取了与谷歌(GOOGL)"Gemini Flash"系列类似的策略,以提供更快速、更高效的AI模型。
GPT-5.3-Codex-Spark尤其强调低延迟响应速度。这是OpenAI上月与AI芯片初创公司Cerebras Systems达成约144亿韩元规模合作伙伴关系的成果。OpenAI将"Spark"列为该芯片合作的首个成果,并透露该模型实际运行于Cerebras的下一代半导体平台"WSE-3"之上。该芯片是搭载了超过4万亿个晶体管的硅晶圆尺寸AI专用处理器。
此次公开的Spark正如其名,旨在实现"快速推理"。OpenAI解释称,该模型不仅限于生成代码,还能参与开发者通常执行的大多数工作,如实时协作、调试、部署、指标分析、文案修改、用户调查等。相比之前的GPT-5.2,其平均响应速度提升了25%,在特定类型任务中,令牌使用量也减少了近50%。
在AI模型性能比较指标Terminal-Bench 2.0中,Spark也取得了77.3%的准确率,大幅超越了GPT-5.2-Codex的64%。在游戏和网络开发领域也观察到了类似的性能改进。
有趣的一点是,该模型在其自身开发过程中也扮演了"助手"角色。OpenAI方面表示,早期版本的Spark被用于模型学习调试、部署管理、测试结果诊断等多方面,以改进其自身。这种"自我加速开发"的案例被认为是大型AI模型开发中罕见的做法。
目前,GPT-5.3-Codex-Spark仅向付费ChatGPT用户提供,并即将以API形式公开。其价格或使用限制与现有的GPT-5.3-Codex模型相同。
OpenAI强调,此次公开是其长期战略的第一步。公司将并行运营"双重模式战略",即针对实时协作优化的轻量代理,以及能够处理长时间复杂任务的深度模型。对此,Cerebras联合创始人Sean Lie表示:"AI推理速度一旦改变,其模式、应用场景和用户体验都将彻底改变,此次发布仅仅是序幕。"
另一方面,Cerebras近期获得了14.4亿美元(约2.0673万亿韩元)的追加投资,企业估值达到230亿美元(约33.12万亿韩元)。计划于今年上半年进行首次公开募股(IPO)的该公司,将与OpenAI展开更深入的战略合作。对于在AI半导体市场上与英伟达(NVDA)竞争的Cerebras而言,此次合作预计也将成为一个决定性的转折点。


