OpenAI 推出 GPT-6 Astra Ultrafast,NVIDIA Blackwell GPU 加速推理
OpenAI 发布 GPT-6 Astra Ultrafast,基于 NVIDIA Blackwell GPU 运行,现已通过 API 向部分用户开放。与 Astra Standard 模式相比,Ultrafast 的 token 生成速度最高提升 8 倍,可缩短编码代理的编辑-测试-调试周期,让交互应用更流畅。对开发者而言,这意味着在代理工作流中能更快获得模型响应,减少等待时间。
OpenAI 于今日宣布,GPT-6 Astra Ultrafast 现已通过 OpenAI API 向符合条件的 ChatGPT Work 和 Codex 用户开放。该模型运行在 NVIDIA Blackwell GPU 上,借助 OpenAI 针对 NVIDIA Blackwell 架构优化的推理技术,实现了比 Astra Standard 模式最高 8 倍的 token 生成速度提升。\n\n对于开发者而言,更快的生成速度意味着编码代理的编辑-测试-调试循环可以缩短,在工具调用之间生成响应的时间减少,交互式应用也会显得更加灵敏计算\n\nOpenAI 推理负责人 Philippe Tillet 表示,NVIDIA 在工具和文档方面的深度投入,让 OpenAI 的模型能针对 Blackwell 和 Rubin GPU 进行编程优化计算Astra 能将这种知识转化为高性能内核,使 NVIDIA 硬件在延迟、吞吐量和成本方面表现出色计算\n\nOpenAI 还在持续优化推理性能,利用自身模型来改进运行在 NVIDIA GPU 上的推理软件计算通过 NVIDIA 平台的可编程性,OpenAI 得以测试和实施改进,从而让模型响应更快计算OpenAI 计算首席技术官 Uday Ruddarraju 指出,与 NVIDIA 的合作帮助 OpenAI 让 AI 更快更有用,其内部模型被用于优化 NVIDIA GPU 上的推理流程计算\n\nNVIDIA 平台的可编程性允许开发者在训练、推理和强化学习之间复用基础设施,根据需求变化灵活调配计算资源,提高利用率并避免过度部署计算开发者现已可通过 API 使用 GPT-6 Astra Ultrafast,具体访问方式、定价和实现细节参见官方 Ultrafast 指南计算
本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。