最高每秒生成 750 个词元:OpenAI 推 Ultrafast 模式,GPT-5.6 Sol AI 提速 14 倍
发布于 · 8月14·周五 来源 · IT之家

最高每秒生成 750 个词元:OpenAI 推 Ultrafast 模式,GPT-5.6 Sol AI 提速 14 倍

OpenAI 为 GPT-5.6 Sol 推出 Ultrafast 模式,由 Cerebras 支持,速度提升 14 倍,最高每秒生成 750 个词元,兼顾速度与能力。

关键词OpenAIGPTUltrafastGPT-5.6SolAICerebras最高每秒生成

时间:2026年8月13日(周四)发布预览

地点:美国,全球首批受邀企业客户

人物:OpenAI产品团队、Cerebras Systems(芯片合作方)、OpenAI企业API客户

事件详情:

OpenAI于8月13日发布"Ultrafast"(超高速模式)预览版,让GPT-5.6 Sol模型的处理速度提升至标准模式的14倍,最高可达每秒750个输出token。这一服务等级依托OpenAI与AI芯片公司Cerebras的合作,由Cerebras晶圆级推理硬件驱动。预览版率先在OpenAI API中向小部分客户开放,后续将随产能爬坡扩大使用范围。

OpenAI表示,Ultrafast旨在把"最强智能"带入"对延迟最敏感"的工作流,具体包括事件响应与可靠性、金融研究与风控、实时客服与语音对话、电商购物流程、实时研究与实验等场景。竞争对手Anthropic此前也推出了Claude Fast Mode,但OpenAI此次的速度提升幅度远超同行。

背景:

大模型推理速度一直是企业级部署的核心瓶颈。过去若想获得实时响应,企业通常需要选择更小或更专门的模型,牺牲智能换取速度。OpenAI此次Ultrafast模式突破传统权衡,让最大参数量、最智能的GPT-5.6 Sol也具备工业级实时推理能力。这背后是Cerebras晶圆级芯片的推理优势——其Q2财报显示,核心云服务营收同比增287%至1.28亿美元,OpenAI正是其关键客户之一。

影响:

Ultrafast预览版的推出意味着OpenAI在企业级AI推理市场对Anthropic形成新的差异化优势。14倍速提升让"实时AI代理"从概念走向现实:金融交易止损、客服语音交互、代码事故应急响应等场景都将因响应速度提升而变得可行。对Cerebras而言,单一大客户OpenAI的规模化使用将带动其推理云业务持续翻倍增长,进一步巩固其在非英伟达AI芯片供应商中的地位。

总结:

OpenAI联合Cerebras推出Ultrafast模式,让GPT-5.6 Sol获得14倍速提升与每秒750 token输出,把"最强智能"首次带入工业级实时场景。这一动作既巩固了OpenAI在企业推理市场的领先优势,也成为AI芯片新势力Cerebras打入大客户的关键背书。

参考来源:

[1] https://openai.com/index/previewing-ultrafast

[2] https://techcrunch.com/2026/08/13/openai-introduces-ultrafast-a-new-mode-that-makes-gpt-5-6-sol-work-at-14x-the-speed/

[3] https://news.qq.com/rain/a/20260814A026W400

[4] https://www.jiemian.com/article/14914720.html

[5] https://www.donews.com/news/detail/1/6669549.html

[6] https://wap.eastmoney.com/a/202608133839575542.html。

本站展示内容为基于公开信息的资讯解读与整理,不代表原文转载。如需核实细节或获取完整报道,请通过下方链接访问原始来源。