OpenAI“辣椒”芯片超越英伟达Blackwell
12 小时前 1 阅读来源:newsletter.semianalysis.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
OpenAI在Hot Chips大会上正式发布了自研推理芯片“Jalapeño”,这款芯片由OpenAI与博通(Broadcom)合作开发,从2024年年中启动设计到完成流片仅用了约16个月,堪称ASIC(专用集成电路)开发速度的异类。更令人意外的是,根据SemiAnalysis的实测数据,Jalapeño在多个主流开源模型上的性能功耗比(perf/W)全面超越了Nvidia的Blackwell架构芯片,甚至包括AMD和Google的旗舰产品。SemiAnalysis受邀进入OpenAI实验室,用其InferenceX基准测试套件对芯片进行了验证,结果显示Jalapeño在低并发场景下,单用户token生成速度超过每秒700 tokens(DeepSeek R1模型),而在Kimi-K2.5和GPT-OSS模型上更是达到了约每秒1400 tokens。
这一成绩的取得并非依靠针对特定模型的过度优化,而是OpenAI在硬件与软件协同设计上的极致投入。尽管外界普遍认为OpenAI的芯片是为自家模型量身定制的,但SemiAnalysis指出,Jalapeño实际上是一款通用推理芯片,能够高效运行各类模型和负载。OpenAI甚至开玩笑地用Codex提示词将经典游戏《Doom》移植到了该芯片上运行,以证明其通用性。值得注意的是,Jalapeño在测试中并未使用多token预测(MTP)技术,而对比的Nvidia等竞品均开启了MTP,这进一步凸显了其架构效率。此外,芯片采用HBM4内存,使其在规格上与Nvidia和AMD的旗舰GPU直接对标。SemiAnalysis也提醒,所有数据由OpenAI提供,他们虽在实验室现场验证了InferenceX的运行,但未跑完完整基准套件,也未看到AgentX(其偏好的智能体测试套件)的结果,因此仍需保持一定审慎态度。
对于中国跨境电商卖家和AI从业者而言,这一事件释放了几个关键信号:首先,OpenAI自研芯片的快速落地意味着AI推理成本可能在未来大幅下降,这将直接影响依赖大模型API的SaaS工具和自动化服务的定价逻辑;其次,通用推理芯片的崛起可能打破Nvidia在AI算力市场的垄断格局,为云服务商和大型企业提供更多选择,从而间接影响算力采购成本;最后,OpenAI在16个月内完成从团队组建到流片的开发周期,展示了AI辅助芯片设计的巨大潜力,这对国内芯片创业公司来说既是激励也是压力。随着推理成本持续走低,跨境电商在智能客服、选品分析、广告文案生成等场景的AI应用门槛也将进一步降低,值得卖家持续关注这一领域的进展。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
