OpenAI联手Cerebras发布极速代码模型

导语

2月12日,OpenAI 发布轻量极速代码模型 GPT-5.3-Codex-Spark,主打”实时结对编程”体验。引人注目的是,这款模型并未运行在英伟达 GPU 上,而是部署于 AI 芯片新贵 Cerebras 的晶圆级处理器 WSE-3 之上——这是 OpenAI 首次将主力模型的大规模推理交给英伟达之外的芯片公司。

快到什么程度

据 OpenAI 披露,Codex-Spark 的生成速度超过每秒 1000 个 token,首 token 时延较标准版降低约 50%,上下文窗口为 128K。它是 GPT-5.3-Codex 的轻量版本,专为快速迭代、实时协作的代码场景优化,以研究预览形式向 ChatGPT Pro 用户、Codex 应用与 VS Code 开放。

Cerebras 的 WSE-3 是一颗”晶圆级”芯片:整块 300mm 晶圆即一颗处理器,集成约 90 万个 AI 核心与 44GB 片上 SRAM,内存带宽高达 21PB/s,从根本上缓解了推理中的数据搬运瓶颈。

战略信号

OpenAI 与 Cerebras 的多年期合作价值超过百亿美元,Spark 是该合作的首个重要交付。OpenAI 强调,GPU 仍是训练与通用推理的基石,Cerebras 则补足对时延极度敏感的场景——两者是互补而非替代。

但时机耐人寻味:此前有媒体报道,英伟达对 OpenAI 的千亿美元投资承诺已被大幅缩减。在 AI 算力需求膨胀、供应链议价权转移的背景下,OpenAI 的算力多元化布局正从传闻变为现实。

影响与展望

  • 推理芯片战争:低时延推理成为新战场,Cerebras 等”非英伟达”架构迎来证明自己的窗口。
  • 开发者体验:秒级代码生成将重塑编程工作流,”结对编程 AI”从概念走向日常。
  • 供应链多元化:大模型公司自建与外采多元算力的趋势不可逆转,芯片格局或加速分化。

发表评论