OpenAI“辣椒芯片”基准测试显示:专为大规模快速推理打造
10 小时前 1 阅读来源:techcrunch.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
在周二举行的Hot Chips大会上,OpenAI首次对外披露了其自研推理芯片Jalapeño的详细技术细节及首批基准测试结果。这一动作标志着OpenAI在摆脱对英伟达GPU的深度依赖、构建自主算力体系的道路上迈出了实质性一步。据OpenAI硬件负责人Richard Ho在发布会上透露,Jalapeño在SemiAnalysis的InferenceX基准测试中,无论是单位功耗下的吞吐量还是每用户获得的token数,均优于当前市面上最先进的推理处理器——包括英伟达的Blackwell系统。Ho直言:“结果显示出相较于现有技术水平的非常显著的性能飞跃。Jalapeño能在单位电力下处理更多AI任务,同时响应速度更快。它既能高效服务大量客户,也能保持极低延迟。”
Jalapeño芯片最早于去年10月对外公布,由OpenAI与博通(Broadcom)紧密合作开发,OpenAI自家的模型也深度参与了芯片设计过程。值得注意的是,此次基准对比的对象是英伟达Blackwell系统,但Ho也坦承,等到Jalapeño在2026年底以“极小规模”开始部署、2027年实现更大规模落地时,竞争对手的技术可能已经又向前推进了一大截。从架构设计上看,OpenAI将Jalapeño定位为一个多代际平台,旨在让AI产品、模型、芯片和内存能够协同演进。这种全栈式开发思路让OpenAI得以针对推理过程中最易产生瓶颈的环节进行定向优化——特别是prefill(预填充)阶段和通信阶段。OpenAI在发布结果的博客中解释称:“我们设计Jalapeño的初衷就是最大限度减少数据移动和通信延迟。这意味着模型状态(包括生成响应时使用的KV缓存)可以被显式放置并保持在本地,系统则根据每个推理阶段的需求,灵活调配计算、内存和网络的组合。”
对于中国跨境电商卖家和AI从业者而言,这一消息释放了几个关键信号。首先,OpenAI自研芯片的推进速度远超外界预期,从去年10月官宣到今年8月拿出测试数据,仅用了不到一年时间。其次,Jalapeño在推理效率和能效比上的突破,意味着未来AI服务的单位成本有望大幅下降——这对于依赖API调用大模型做选品分析、客服自动化、广告文案生成的跨境卖家来说,是直接的成本利好信号。当然,也要清醒看到,2026年底才小规模部署、2027年才规模化的时间表,意味着短期内英伟达仍将主导AI算力市场,卖家们目前使用的各类AI工具和服务不会马上发生价格或性能上的剧变。但长期来看,当OpenAI能够用自研芯片以更低成本提供同等甚至更强的推理能力时,整个AI应用层的定价逻辑和竞争格局都可能被重塑。对于正在规划AI投入预算的卖家来说,这或许是一个值得纳入中长期考量的变量。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
