AWS发布Inferentia3推理芯片,能效大跃进

AWS 发布了新一代自研推理芯片 Inferentia3,在 AI 推理能效上实现大幅提升。这是亚马逊云科技在 AI 芯片自研路线上的又一次重要迭代,目标直指数据中心推理成本高企的痛点。

Inferentia3 强在哪里

作为 Trainium 训练芯片的姊妹产品,Inferentia 系列一直专注推理场景。据 AWS 披露,Inferentia3 在推理效率上较上一代有代际级提升,特别优化了大语言模型与智能体工作负载的吞吐与延迟表现。

对 AWS 的云客户而言,Inferentia3 实例的意义在于”更便宜的推理”:同样的模型服务请求,在自研芯片上运行的成本显著低于通用 GPU 实例。在推理需求爆发的 2026 年,这正是客户最敏感的指标。

云巨头的芯片自研竞赛

AWS 并非孤军奋战:谷歌有 TPU,微软有 Maia,Meta 有 MTIA,四大云巨头全部下场自研 AI 芯片。背后的逻辑一致——推理规模越大,自研芯片节省的成本越可观;同时也能摆脱对英伟达供应链的单一依赖。

值得注意的是,几乎同一时间传出消息:Alchip 的大客户 3nm AI 加速器进入量产,市场普遍解读为 AWS 下一代 Trainium 芯片。AWS 的芯片路线图正在加速兑现。

影响展望

Inferentia3 的发布将进一步压低云端推理价格,可能引发新一轮的云厂商 AI 服务降价。对英伟达而言,云巨头自研芯片分流的是最赚钱的推理增量市场,”卖铲子”的生意正在面临”自造铲子”的挑战。

发表评论