AI工具AI评分 头条 (88)AI 中文改写

英伟达GPU如何加速OpenAI的GPT-6 Astra超高速运行

7 小时前 1 阅读来源:blogs.nvidia.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

OpenAI 最新上线的 GPT-6 Astra Ultrafast 模式,背后跑在英伟达 Blackwell 架构 GPU 上。这一模式目前已通过 OpenAI API 向开发者开放,同时也面向符合条件的 ChatGPT Work 和 Codex 用户。相比此前的 Astra 标准模式,Ultrafast 的 token 生成速度最高提升到 8 倍,核心原因是 OpenAI 针对英伟达 Blackwell 架构做了推理层面的深度优化,把硬件能力真正吃透了。 对开发者来说,速度提升带来的不只是“快一点”的体验改善。写代码的智能体(agent)通常要反复执行“改代码—跑测试—调试”的循环,还要在调用工具、等待结果、决定下一步之间来回切换。每一次模型响应变快,整个工作流的等待时间就会被成倍压缩。OpenAI 推理负责人 Philippe Tillet 表示,英伟达在工具链和文档上的长期投入,让 OpenAI 的模型能够针对 Blackwell 和 Rubin GPU 生成高性能计算内核(kernel),从而在延迟、吞吐和成本三个维度上都具备竞争力。换句话说,Astra 不只是会写代码,还能写出让英伟达硬件跑得更快的底层代码。 更值得关注的是,性能优化并没有在模型部署后就停止。OpenAI 正在用自家模型反过来优化跑在英伟达 GPU 上的推理软件,借助平台的可编程性不断测试和实施改进。OpenAI 算力首席技术官 Uday Ruddarraju 称,这种合作让 AI 变得更快、更有用。对跨境电商卖家和出海团队而言,这意味着依赖 AI 编程助手、自动化工具链和智能客服等场景的产品,响应速度会持续改善,而底层算力的复用效率提升,也可能间接降低推理成本。目前开发者已经可以通过 API 使用 GPT-6 Astra Ultrafast,具体接入方式、定价和实现细节可参考 OpenAI 发布的 Ultrafast 指南。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · blogs.nvidia.com

内容版权归原作者及 blogs.nvidia.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0 条

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容