OpenAI新模型跑上英伟达新卡

OpenAI 放出了 GPT-6 Astra 的 Ultrafast 模式,直接跑在英伟达 Blackwell 上,API 和 ChatGPT Work、Codex 的合格用户已经能用。官方说法是 token 生成速度最高能到标准模式的 8 倍,这个数字放在 agent 场景里就不是跑分好看那么简单了。

我自己做跨境工具链,最直接的感受是 agent 的 edit-test-debug 循环被压缩了。以前一轮工具调用之间等模型吐字,体感就像网速卡在 3G,现在响应快了,交互式应用的「跟手感」明显不一样。- Ultrafast 模式:token 生成最高快 8 倍,面向 API 和 ChatGPT Work、Codex 合格用户开放
- 底层硬件:英伟达 Blackwell GPU,配合 OpenAI 侧的推理优化
- 受益场景:编码 agent 的编辑-测试-调试循环、工具调用之间的等待、交互式应用响应OpenAI 推理负责人 Philippe Tillet 有句话挺有意思,说英伟达在工具链和文档上的投入,让他们的模型特别擅长给 Blackwell 和 Rubin 写高性能 kernel。这话反过来听,就是模型能力已经开始反哺硬件适配,软硬绑定的护城河又厚了一层。对做出海产品的团队来说,这意味着两件事。一是实时类 AI 功能的成本结构会变,延迟降下来之后,以前不敢做的流式交互可以重新算账;二是选型上更要想清楚,绑 OpenAI 加英伟达这条线,速度红利是真的,但议价空间和迁移成本也得提前留一手。
2

评论

登录后即可发表评论

参与讨论,和出海同行交流想法与经验

还没有评论,来抢沙发吧

说说你的看法,第一条评论最显眼