一夜之间,GPT-5.6 Sol被OpenAI加速了14倍

marsbit发布于2026-08-14更新于2026-08-14

文章摘要

8月14日,OpenAI联合AI芯片厂商Cerebras正式预览了其旗舰模型GPT-5.6 Sol的新服务层级“超高速模式”。在该模式下,GPT-5.6 Sol的输出速度最高可达750 tokens/s,相比标准模式提速最高达14倍,且不降低质量。横向对比,其速度比Claude Fable 5快11倍,比Opus 4.8快5倍。 在“人类最后的考试”基准测试中,GPT-5.6 Sol超快模式仅用11小时11分钟就完成了全部2500道难题,而Claude Fable 5需要超过78小时。该模式在GDP-Val等基准上也实现了显著的端到端速度提升。 此次突破主要依赖于Cerebras的晶圆级硬件架构。其最新的WSE-3芯片集成了4万亿晶体管和44 GB片上SRAM,使模型参数能常驻在超高带宽的片上内存中,避免了传统GPU因内存带宽限制而产生的数据搬运延迟。对于参数量超过单芯片容量的模型,Cerebras采用了多晶圆流水线并行机制。 更快的推理速度为实时应用开辟了新可能,例如事件响应、金融分析、客户支持、商务推荐和实时研究等。OpenAI内部已在事件响应和研究迭代等场景中测试该模式,显著缩短了从发现问题到制定方案的延迟。 超高速模式将率先在OpenAI API中推出,目前已有部分客户获得有限预览。此举意味着许多原本需切换至次级模型的任务,现在可直接使用旗舰模型快速完成,有望改变AI使用方式。

AI 开始卷信息不对等了?

8 月 14 日凌晨,OpenAI 联合 AI 芯片厂商 Cerebras 正式预览了其旗舰模型 GPT-5.6 Sol 的全新服务层级「超高速模式」(Ultrafast Mode)。

在该模式下,GPT-5.6 Sol 的输出速度最高可达 750 tokens/s,相比目前 Standard(标准)模式约 53 tokens/s 的推理基线,速度提升最高达 14 倍,同时不降低任何质量。横向对比的话,GPT-5.6 Sol 加速后比 Fable 5 快 11 倍,比 Opus 4.8 在 Fast 模式下快 5 倍。

Ultrafast 模式将率先在 OpenAI API 中推出,当前已面向部分客户推出有限预览版。

为此,OpenAI 与 Cerebras 还对当前先进 AI 大模型现在的速度和智力对比拉了个表格,GPT-5.6 Sol Ultrafast 处于绝对领先的位置:

在 Cerebras 的博客中,工程人员介绍了在「人类最后的考试」(Humanity's Last Exam, HLE)上进行的测试,他们把 Ultrafast 后的模型与直接竞对进行了对比。我们知道,HLE 是一项具有挑战性的模型基准,包含 2500 道题,通常只有化学、经济学和文学等领域的博士才能解答。

GPT-5.6 Sol 在超快模式下仅用 11 小时 11 分钟就回答了全部问题。而 Claude Fable 5 则需要 78 小时 27 分钟,也就是超过三天的连续计算才能得出相同的结论。GPT 超快模式仅用一个工作日就完成了人类知识的前沿领域,在准确率相近的同时,速度几乎是 Claude Fable 的 7 倍。

随着模型能力的不断提升,快速推理的应用范围也会扩大。GPT-5.6 Sol 是 OpenAI 迄今为止在法律文书、金融模型和工程报告方面表现最佳的模型。在 GDP-Val(衡量经济价值知识工作任务的基准)上,Ultrafast 实现了 5.6 倍的端到端速度提升,且质量未受影响,充分展现了更快的推理速度如何加速经济价值工作的开展。

更快的 AI 处理速度为新兴工作流增加了不少可能性,人们现在可以将智能体部署到问题的关键路径上。OpenAI 为你列举了一些应用场景:

  • 事件响应和可靠性:当关键系统发生故障时,AI 分析应用程序日志、最近的代码更改和工程师报告,以确定可能的原因,并在故障仍在发生时帮助准备修复方案。
  • 金融研究与安全:在市场形势瞬息万变的情况下,分析市场信号、评估交易并识别可疑活动。
  • 客户支持和语音:实时解决复杂的客户问题,即使找到答案需要多个步骤或系统,也不会中断对话。
  • 商务:在购物者还在犹豫不决时,回答产品问题、检查库存、个性化推荐并解决结账问题,避免犹豫演变成放弃购物车。
  • 实时研究和实验:将以前需要一夜才能完成的研究变成交互式工作会议,让团队测试想法、检查结果、调整方法,并在不中断工作流程的情况下进行另一次实验。

在 OpenAI 内部,开发人员在超快速模式下测试了 GPT-5.6 Sol,事件响应是使用 Ultrafast 的一个例子。当警报触发时,工程师需要在系统和证据仍在变化的情况下构建准确的事件图景。借助 Sol 级别的智能,团队可以快速读取日志、分析跟踪信息、汇总对话、确定下一步检查,并协助准备或验证修复方案。Ultrafast 模式缩短了从观察到信号、验证假设到选择下一步行动之间的延迟,同时工程师仍然负责判断和部署。

在研究方面,OpenAI 团队使用 Ultrafast 来快速搜索知识库、查询数据,并快速收集、整理和汇总来自不同工具的信息。以往研究中常见的流程是,团队成员在夜间启动一批实验,并在第二天早上查看结果。而有了 Ultrafast,发现的流程可以缩短,从而支持在工作日内进行多次迭代。

Ultrafast 模式的突破在于打破了传统 GPU 集群在大模型推理解码阶段的内存带宽瓶颈,其实现主要依赖于 Cerebras 的晶圆级硬件架构。

在 AI 芯片厂商行列中,Cerebras 的解决方案独树一帜:其历代芯片采用整片晶圆制成,在单片上集成了海量计算核心与超高速互联网络。

传统 GPU 在运行大模型自回归解码生成 Token 时,受限于显存带宽,需要不断将庞大的模型权重在片外 HBM 和计算核心之间往返搬运;同时多卡切分还会带来跨芯片互连(PCIe/NVLink)的通信延迟。

而每块 Cerebras 最新的晶圆级芯片(WSE-3)集成了 4 万亿晶体管,125 petaflops 的 AI 算力和高达 44 GB 的片上高速 SRAM,模型参数直接全部常驻在超高带宽的片上 SRAM 中,避免了反复从片外内存加载权重的等待时间。

当然,GPT-5.6 Sol 作为前沿旗舰模型,完整参数量显然远超芯片容量。Cerebras 还有「多晶圆流水线并行(Pipelined across wafers)」机制,其将模型的各网络层分别分布于多颗晶圆上,每层参数常驻于各自芯片的 SRAM 中,能让 Token 在晶圆间无缝流水传输。

对于众多大模型用户来说,旗舰模型 14 倍速会意味着以前不少必须切换次级模型(如 Luna 和 Terra)的任务现在可以直接放心地满血跑,对于需要多轮工具调用、代码生成排错和复杂链式思考的 Agent 任务,原本需要几小时的流程可压缩至几分钟完成。

更快的速度或许也意味着我们使用 AI 的方式发生转变:

AI 社区里,人们已经在期待 Luna 和 Terra 版的超高速模式了,就是不知道 Cerebras 的芯片是否够用。

参考内容:

https://openai.com/index/previewing-ultrafast/

https://www.cerebras.ai/blog/accelerating-gpt-5-6-sol-ultrafast-with-openai

本文来自微信公众号“机器之心”(ID:almosthuman2014),作者:关注大模型的机器之心

热门币种推荐

相关问答

QOpenAI 联合哪家AI芯片厂商推出了GPT-5.6 Sol的「超高速模式」?

AOpenAI 联合了AI芯片厂商 Cerebras。

QGPT-5.6 Sol 在「超高速模式」下的输出速度是多少?比标准模式快了多少倍?

A在「超高速模式」下,GPT-5.6 Sol 的输出速度最高可达 750 tokens/s,相比标准模式约 53 tokens/s 的速度,提升最高达14倍。

Q在「人类最后的考试」(HLE)测试中,GPT-5.6 Sol在超快模式下花了多长时间完成全部题目?相比竞品Claude Fable 5快了多少倍?

A在HLE测试中,GPT-5.6 Sol在超快模式下仅用11小时11分钟就回答了全部2500道题,而Claude Fable 5需要78小时27分钟,速度上快了大约7倍。

QCerebras 的晶圆级芯片实现AI大模型高速推理的核心技术优势是什么?

ACerebras的晶圆级芯片(如WSE-3)集成了海量计算核心与超高速互联网络,并拥有高达44 GB的片上高速SRAM。这使得大模型的权重参数可以常驻在片上高速内存中,避免了反复从片外内存加载权重的等待时间,从而打破了传统GPU集群在解码阶段的内存带宽瓶颈。

Q文章列举了哪些GPT-5.6 Sol「超高速模式」的潜在应用场景?(请至少列举三个)

A文章列举了多种应用场景,包括:1. 事件响应和可靠性:分析故障日志、代码变更以确定原因并协助修复。2. 金融研究与安全:在市场快速变化时分析信号、评估交易、识别可疑活动。3. 实时研究和实验:将需要整夜完成的研究变为交互式工作会议,支持多轮快速迭代。

你可能也喜欢

跑路、被盗、被骗?Neutrl突然暂停一切协议功能

北京时间8月13日晚,山寨币期现套利协议Neutrl突然宣布,因“协议储备受到影响”暂停所有铸币、赎回等功能。官方未披露具体原因,仅表示已咨询法律顾问,后续将公布处理流程。 Neutrl业务模式类似Ethena,通过折价买入锁仓山寨币并进行永续合约对冲来赚取收益,并将策略打包为产品供用户参与。该模式存在交易平台风险、流动性风险及更高的交易对手违约风险。 社区对此事件猜测纷纷。一种可能是其OTC锁仓代币的交易对手违约,导致风险对冲失衡。但若仅剩空头仓位,在下跌市场中应获利,这与“储备受损”矛盾。另一种更受关注的猜测是团队可能存在问题:有链上数据显示,在公告发布前14分钟,疑似团队地址从流动性池中撤出约350万美元;同时官方关闭了社媒评论区及Discord频道,引发“跑路”担忧。此外,团队部分成员过往参与的其他项目也被质疑。 事件还暴露出第三方“储备证明”工具Accountable的局限性。其提供的偿付能力验证页面在事件后失效,且近期多个被其验证“正常”的协议都出现了问题。评论指出,对于Neutrl这类大量资产在链下(如OTC锁仓代币)的协议,仅证明链上净资产价值不足以反映真实的偿付能力和资产可回收性。 目前事件真相仍未明了,Neutrl团队尚未给出进一步说明。

marsbit4分钟前

跑路、被盗、被骗?Neutrl突然暂停一切协议功能

marsbit4分钟前

稳定币和 Agentic,写不进 Visa 的财报

7月16日,Visa发布稳定币平台VSP,但随后在财报电话会上,CEO虽详细介绍了平台,却未提及其收入模式、商用时间或客户,CFO的财务报告中更是完全未提及VSP。市场与分析师也未将其作为关注焦点。这表明稳定币和AI代理(Agentic)业务在Visa当前的战略和财务中分量有限。 文章通过分析Visa的商业模式来理解其定位。Visa如同一条收费公路,收入主要来自四个环节:服务收入、数据处理收入、国际交易收入和其他收入,综合净费率约为0.29%。其核心策略是维持利益均衡,而非提高费率。 在稳定币方面,Visa目前有规模的相关业务只有两项:一是前端消费的“U卡”(稳定币卡),其本质是将稳定币转换为法币后进行普通卡交易,Visa按标准费率收费;二是后台的稳定币结算试点,用于机构间清算,这只是运营改善,目前不产生额外收入。新推出的VSP平台旨在将结算能力商业化,但尚未开始收费。总体看,Visa从稳定币直接获得的收入微乎其微。 在AI代理(Agentic Commerce)方面,Visa的相关产品(如代理评分、令牌框架)主要是让AI代理能使用其现有支付网络,属于增值服务,按服务收费。Visa重点关注的是代理替代人类进行采购的场景(如差旅预订),而对于代理之间可能产生的高频、小额全新交易类型(机器间采购),其讨论和布局尚不明确。 从战略优先级看,稳定币和Agentic在Visa内部被排在第四档投资方向,位于核心的消费者支付、增值服务、商业与资金流动之后,且公司未为其提供可寻址市场(TAM)预测。与之对比,万事达(Mastercard)近期斥资约18亿美元收购稳定币支付公司BVNK,展现了更激进的投入姿态。 Visa相对保守的策略,源于其深厚的护城河——数十年来建立的消费者保护、争议处理和信任体系。然而,挑战在于,部分交易(如无需争议处理的机器间交易)可能完全绕过卡网络,通过钱包对商户的直接稳定币支付进行。这在日本等地已有试点。 最终,资本市场给予Visa的估值溢价,主要锚定于其稳健的全球消费支出基本盘、持续增长的增值服务以及股票回购,稳定币和Agentic更多是代表未来可能性的“保险”或“期权”,用以证明公司未在技术周期中缺席,但并非当前业绩的核心驱动力。产品发布引发的关注与财报中的沉默之间的落差,更多是叙事层面的放大。

marsbit19分钟前

稳定币和 Agentic,写不进 Visa 的财报

marsbit19分钟前

这个投资者日,闪迪的「炸裂数字」震撼市场

在2026年投资者日上,闪迪公布了2028至2030财年(约2027年7月起的三个财年)的激进长期财务目标,引发市场强烈反应,其股价盘中一度大涨近18%。 **核心财务目标**:公司预计在此期间营收将保持**中高双位数增长**,同时非GAAP口径下的毛利率和营业利润率将分别达到约**80%**和**75%**,调整后自由现金流利润率约**50%**。 **战略重心转变**:闪迪强调将不再盲目追求比特出货量,而是根据**盈利能力优化**的需要,主动灵活调整可供销售的比特量。这意味着公司更看重“每比特的利润”,而非单纯的数量增长。通过在新NAND技术节点切换时主动控制晶圆产出,公司旨在维护市场价格和资本效率。 **资本回报承诺**:公司承诺,在完成支持业务增长的必要投资后,将把**100%的超额现金**返还给股东。 **增长信心来源**: 1. **新商业模式**:已与8家客户签署长期协议(NBM),覆盖了2028财年约三分之二的比特出货量,旨在稳定收入、降低行业周期性影响。 2. **AI推理需求**:公司判断,AI从训练转向推理将催生巨大存储需求,预计到2030年,企业数据中心闪存总市场(TAM)将达到**1.2泽字节(ZB)**。闪迪正在推进高带宽闪存(HBF)等技术以抓住此机遇。 总体而言,闪迪向市场传递了明确信号:AI驱动的需求增长,结合公司对供给的主动管理和新的商业模式,有望使其未来数年摆脱传统存储行业的强周期性,实现持续的高增长与高盈利。

marsbit20分钟前

这个投资者日,闪迪的「炸裂数字」震撼市场

marsbit20分钟前

交易

现货

热门文章

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对SOL(SOL)币价的意见。

活动图片