跳到正文
原文
NVIDIA Blog· Dion Harris·· 2 小时前精选AI 评分60

NVIDIA GPU如何加速OpenAI的GPT-6 Astra Ultrafast

How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast

AI 导读

运行在NVIDIA Blackwell GPU上的GPT-6 Astra Ultrafast现已可通过OpenAI API使用,符合条件的ChatGPT Work和Codex用户也能使用,token生成速度最高比Astra Standard模式快8倍。

推荐理由

对需要反复写代码、调用工具再检查结果的编程智能体来说,最高8倍的token生成速度主要用来缩短每一轮循环里的等待。

正文 · AI 翻译

GPT-6 Astra Ultrafast,运行于 NVIDIA Blackwell GPU,现已在 OpenAI API 中提供,并向符合条件的 ChatGPT Work 和 Codex 用户开放。 

借助 OpenAI 模型利用 NVIDIA Blackwell 架构能力所实现的推理优化加速,Ultrafast 的 token 生成速度最高可达 Astra Standard 模式的 8 倍。对开发者而言,更快的生成可以缩短编程智能体的编辑-测试-调试周期,减少工具调用之间生成响应所花费的时间,并让交互式应用感觉更加灵敏。 

更快的响应在贯穿整个工作流反复出现时最为重要:智能体编写代码、使用工具、检查结果并决定下一步做什么。Ultrafast 将 Astra 的能力带入这些对时间敏感的循环中。NVIDIA AI 基础设施帮助 OpenAI 在开发者需要时提供更多有用的模型输出。 

“NVIDIA 在工具和文档方面的深度投入,使我们的模型在为 Blackwell 和 Rubin GPU 编程方面格外出色,”OpenAI 推理负责人 Philippe Tillet 说。“Astra 可以将这些知识转化为高性能内核,使 NVIDIA 硬件在延迟、吞吐量与成本的整个前沿上都极具吸引力。借助 Astra Ultrafast,这意味着当智能体编写代码、使用工具并处理复杂任务时,模型响应会更快。”

持续提升性能

性能提升并不会在模型部署后停止。OpenAI 正在使用自己的模型来帮助优化运行在 NVIDIA GPU 上的推理软件,并利用该平台的可编程性来测试和实施改进。这项持续的工作可以随着时间推移让模型响应更快,并提高已部署基础设施的生产效率。 

“我们与 NVIDIA 的合作正在帮助我们让 AI 更快、更有用,”OpenAI 计算首席技术官 Uday Ruddarraju 说。“我们使用内部模型优化了 NVIDIA GPU 上的推理,而 NVIDIA 的可编程性帮助我们实现了 Astra Ultrafast 背后的加速。”

可编程的 NVIDIA 平台使开发者和研究人员能够在模型演进过程中,跨训练、推理和强化学习复用基础设施。这种灵活性帮助团队随需求变化重新调配计算资源,提高利用率,并避免为每项工作负载过度配置。

开发者现在即可通过 API 使用 GPT-6 Astra Ultrafast。请参阅 Ultrafast 指南,了解访问方式、价格和实现细节。

来源:NVIDIA Blog · blogs.nvidia.com