Kimi逼得两大巨头改变定价?奥特曼罕见认错,Claude额度重置

marsbit發佈於 2026-07-20更新於 2026-07-20

文章摘要

17日凌晨,Kimi K3发布,定价远低于高端模型,引发行业震动。与此同时,OpenAI CEO萨姆·奥特曼罕见公开认错,称过去12个月表现不佳,但预告公司将迎来“有史以来最出色的12个月”,暗示重大进展。 OpenAI的Codex和ChatGPT Work用户激增,四天内新增300万活跃用户,导致系统压力巨大。几乎同一周,OpenAI与Anthropic展开激烈竞争:OpenAI取消使用限制并重置用户额度;Anthropic则延长Claude Fable 5付费访问并上调Claude Code周额度50%。双方争夺用户背后,意在获取智能体长任务产生的宝贵真实数据。 OpenAI CFO莎拉·弗里亚提出新衡量标准——“每美元有用智能”,强调应计算完成一个合格任务的全成本,而非单纯比较token价格。这揭示了巨头“送额度”背后的逻辑:旨在改变市场计价方式,让用户习惯按“干成多少活”来评估AI价值。 竞争核心是智能体形态的演进。Anthropic的Claude Code和Cowork率先推动AI成为工作伙伴;OpenAI则发布内置Codex的ChatGPT Work,让AI从回答问题转向自动执行复杂任务。奥特曼押注的正是AI全面融入工作流,成为真正的“AI同事”。这场竞赛的胜负,或将取决于谁能更深入地嵌入用户日常,重新定义人机协作。

17日凌晨, Kimi K3发布,全网刷屏,开源AI迎来第二次「 DeepSeek 时刻」。

外媒Axios称,K3定价远低于它所挑战的高端模型,美国AI公司的高价策略还能维持多久?巧的是,就在最近,两大巨头正在打客户争夺战。此前,奥特曼在X上发帖,不提新模型,开头就是一句认错:

过去12个月里,我们的表现并不理想,这主要是我的过错。

一直带领OpenAI与Anthropic贴身肉搏的他,公开把过去一年定性为「不够好」,还主动把锅往自己身上揽,这本身就够反常。

真正让全网炸裂的,是后半句。

奥特曼紧接着话锋一转,说道,OpenAI即将迎来「有史以来最出色的12个月」,团队表现也很出色,「正在迎来让他们满意的结果」。

奥特曼口中,「有史以来最出色的12个月」,到底押的是什么?

全网第一反应几乎是同一个:GPT-6是不是要来了?

几天内

新增了300万活跃用户

「关掉推特,赶快去忙正事」!

与奥特曼的推文遥相呼应的,是OpenAI的Codex负责人Tibo,在16日甩出的一个900万活跃用户的新数字。

把活跃用户数摞在一起看:2月,Codex还不到100万;7月12日600万,14日800万,到16日,Codex和ChatGPT Work合计突破900万。

四天,多了300万人。

Tibo在推文里说,本来想早点把额度调回来,结果被团队为保系统不崩、稳定运行而忙的「数以百万计的任务」给绊住了。

帖子结尾他还提醒大家额度再过几分钟就恢复了,多去忙自己的正事,别总刷推特了。

说白了,就是用户涨得太猛,工程团队正连轴转着堵窟窿。

这让人想起几个月前,Anthropic CEO达里奥的「凡尔赛」。

今年5月,达里奥在开发者大会上说,公司原本按每年10倍增长做规划,结果一季度的收入和使用量按年化算,暴涨了80倍:算力紧张就是这么来的。

他半开玩笑地抱怨:真希望80倍别再继续了,太难扛,盼着回到正常一点的数字,「区区10倍」就好。

两个AI巨头,一个连轴转堵窟窿,一个嫌自己涨太快。智能体的火,烧得比谁的规划都快。

同一周

两家抢着给你送额度

奥特曼这条认错推文,恰好落在OpenAI与Anthropic正打得火热的一场消耗战里。

ChatGPT Work发布后没几天,OpenAI临时取消了Plus、Pro、Business的5小时使用限制,还一轮接一轮重置用户额度:先给约50万用户,再铺到700万用户,人人补一次。

Anthropic也毫不示弱。

它把Claude Fable 5的付费访问又延长了一次,同时把Claude Code的周额度上调50%,两项都续到7月19日。

一边取消限制、疯狂送额度,一边增加访问额度、提高上限。

表面上,两家都在宠用户,实际上是在抢用户。

往深一层看,这是智能体时代的一场军备竞赛:谁能在这波狂热里把用户留住,谁就能攥住更多真实的长任务数据。

最值钱的东西,就是智能体替你干上几个小时活、产生的真实使用数据。谁的额度更松,谁的用户和使用量就更多,谁收到的数据也就更多。

而OpenAI的首席财务官,已经把这套算法用到了对手身上。

按OpenAI给出的口径,在长周期工程任务基准DeepSWE v1.1上,开到最高推理档的GPT-5.6 Sol拿到72.7%,压过Claude Fable 5的69.9%;而估算API成本,比对方低36.2%。

更能得分,还更便宜——这正是「每块钱买到多少活」想证明的东西。同时输出token减少54%,预估API成本降低36.2%。

有意思的是,被点名的Anthropic几乎在同一时间做了另一件事:把Fable 5的付费访问再延一次,Claude Code周额度上调50%,都续到7月19日。

一个用图表证明自己更划算,一个直接把闸门开大让你自己试。

这也解释了,为什么两家宁可扛住系统压力,也要拼命把使用量往上推。高强度的真实使用本身,就是护城河。

不过,也有人从这波狂飙里嗅出了别的味道。

经济学者Jeremy Nguyen评论「Codex和Claude Code同一天重置额度」时说,也许多年以后,我们会跟年轻人讲起早期这场「智能体token大战」,讲token当年被补贴得有多疯。

他翻出了互联网泡沫的旧账:那时候,有创业公司为了让你在电脑上挂个广告条,每月倒贴你几百美元。

他的问题很实在:如果这样的窗口只有一次,该怎么趁现在,把Codex和Claude Code用到值回票价?

而这条赛道上,Anthropic的Claude Code同期的动作不断,面向金融、工程的企业智能体早已落地。

两家的智能体之战,才刚刚打响。

认错几小时后

CFO递上一张账本

巧的是,就在奥特曼发帖的同一天,OpenAI官网上线了另一篇文章。

作者不是奥特曼,是CFO Sarah Friar。

Friar开篇就说,她在各处听到CFO们问的是同一个问题:怎么让AI这笔钱花得更值。她给出的答案是一把新尺子——Useful Intelligence per Dollar,每块钱买到多少有用的智能。

过去衡量软件成功,看的是采纳率:买了多少个席位、多少人活跃、续费了多少。Friar说,AI要换个更狠的口径:看干成了多少活

她甚至直接点破了「token单价」这个幻觉:最低token价格 ≠ 最低结果成本

便宜的模型token是便宜,但可能要试更多次、耗更多时间、让人多审几遍;贵的模型一次过。真正该算的,是每完成一个合格任务的总成本,真正该计算的是

全成本公式 =(模型调用费用 + 计算资源 + 人工审查时间 + 重试次数 + 返工成本)÷ 成功达标任务数。

真正决定性价比的,从来不是单次token价格,而是一次成功任务的完整成本

GPT-5.6家族(Sol旗舰、Terra平衡、Luna高速低价)正是为此而生。

一个支持团队的「完成」,是客户问题被解决;工程团队的「完成」,是代码改动通过测试;法务团队的「完成」,是合同审完且没出错。

读到这儿,回头看前面那场额度大战,味道就变了。

OpenAI取消5小时限制、一轮轮重置额度,Anthropic上调Claude Code周额度50%——这不只是补贴用户抢数据。当计价单位从「席位」和「token」变成「完成的工作」,送额度就不是让利,是换口径

谁先让所有人习惯用「干成多少活」来算账,谁就重新定义了这个市场怎么比。

能力赢得首次使用,可靠性让AI成为工作方式本身。

随着使用量增长,每一美元AI是否在为你创造更多价值?

答案藏在计算基础设施飞轮里:更好基础设施 → 更强模型 → 更好产品 → 更高采用 → 更多收入 → 持续投入下一代研究与算力。

当同一工作流随时间推移,成功任务数增长速度超过总成本,且质量不降反升时,「每美元有用智能」就实现了正向复利。

双雄争的

是谁当上你的AI同事

如果将视角放远,看得更清楚。

年初先出手的是Anthropic。Claude Code在开发者里一战封神,紧接着的Cowork把智能体从程序员推向普通知识工作者,在「AI办公」这块抢下先手。

OpenAI在7月9日发布的ChatGPT Work,几乎是贴着Cowork的卖点打,内置Codex,还捎带上线了当天同步发布的最新模型GPT-5.6 Sol。

一句「帮我建个项目追踪表」,它就交出一张18个项目、29个待办事项的甘特图:这不是聊天,是交活。

这次变的不是参数,是形态。

过去用ChatGPT是你提问、它回答;现在你只给一个目标,剩下的它自己来:拆任务、调工具、翻你的文件和应用,一口气干上几个小时,直到把活儿真做出来。

官方一句话说透了定位:ChatGPT不再只是回答问题的机器,而是你攻坚复杂工作的伙伴。

OpenAI也拿整个公司做了实验:如今内部几乎100%的团队,从财务到销售,都在用ChatGPT Work和Codex干活。

此外,和Anthropic相比,OpenAI手里还多一张短期无解的牌:分发。

Cowork得让用户主动下载一个桌面端;而把智能体揉进ChatGPT,意味着超9亿周活用户打开那个最熟悉的App,就已经在用智能体了。

奥特曼自己的说法是,agentic产品的使用量一周环比涨了2.5倍。这条曲线,正是撑起他「下一年最强」的底气之一。

回到奥特曼那句预告。

他押注的大概率不是一款叫GPT-6的新模型,而是一次更彻底的形态切换:让AI从「回答问题」,正式变成「替你干活」。而Friar那把尺子,正是为这次切换准备的——当AI开始干活,衡量它的就不再是参数,而是干成了多少活、花了多少钱。

一个在前台喊话,一个在后台改账本。

这场竞争最后的胜负,或许不取决于谁的模型更强,而取决于谁先真正住进每个人的工作流里,成为你的AI「同事」。

参考资料:

https://x.com/sama/status/2077817060068057493?s=20

https://x.com/JeremyNguyenPhD/status/2077719990116258162

本文来自微信公众号“新智元”,作者:ASI启示录,编辑:元宇 Aeneas

相關問答

Q根据文章,Kimi的K3发布后,美国AI公司的高价策略可能面临怎样的挑战?

AKimi K3的定价远低于它所挑战的高端模型,外媒Axios认为这可能迫使美国AI公司重新评估并调整其高价策略,使其难以长期维持。

Q奥特曼在X上的推文中,对OpenAI过去一年的表现做了怎样的评价?

A奥特曼表示,OpenAI在过去12个月里的表现并不理想,他主动承担责任,称这主要是自己的过错,并将这一年定性为「不够好」。但他随即表示公司即将迎来「有史以来最出色的12个月」。作者认为,这可能预示着OpenAI在智能体(agent)产品形态上将有重大进展。

QOpenAI首席财务官Sarah Friar提出的衡量AI价值的新标准是什么?

ASarah Friar提出了「每块钱买到多少有用的智能」这一新标准。她认为衡量AI价值不应只看token单价或采纳率,而应计算完成一个合格任务的全成本,包括模型调用费用、计算资源、人工审查时间、重试次数和返工成本等,除以成功达标任务数,以此评估性价比。

Q文章中提到的OpenAI和Anthropic之间的“消耗战”或“军备竞赛”具体指什么?

A指两家公司为了争夺用户和获取真实的、长时间的任务数据而展开的激烈竞争。具体表现为:OpenAI取消使用限制、重置用户额度;Anthropic则延长付费访问时间、上调使用额度。其核心目的是通过提供更宽松的使用条件来吸引和留住用户,从而收集更多高质量的使用数据来训练和改进自己的智能体模型。

Q文章认为,ChatGPT Work的发布标志着AI的形态发生了怎样的转变?

AChatGPT Work的发布标志着AI从「回答问题」的聊天机器向「替你干活」的工作伙伴或“AI同事”转变。用户只需给出一个目标,AI就能自主拆解任务、调用工具、处理文件,连续工作数小时以交付实际成果,而不仅仅是提供信息或建议。

你可能也喜歡

64 岁赚 9100%,Pons 掀起 Robinhood 混战

一位64岁交易员Bonk Guy在社交平台fomo的盈利榜登顶,他通过投资Robinhood链上的代币发行平台Pons的平台币PONS,用约6.7万美元获得了近9100%的账面涨幅,其公开的现货交易累计盈利已超过1000万美元。这一现象背后是Robinhood Chain上多家Launchpad平台之间的激烈竞争。 Pons平台凭借其独特的经济模型脱颖而出:新代币发行和交易产生的手续费中,有部分会用于回购并销毁PONS代币,从而将平台活跃度与代币价值直接绑定。这使其占据了该链上大部分的发币量和交易份额。与此同时,Uniswap Labs也推出了低费率的竞争平台Pools,但市场份额仍不敌Pons。值得注意的是,Uniswap Labs随后又购入了PONS代币,被市场解读为“打不过就加入”,实则是押注该链的流量价值。 另一平台LONG则主打将股票代币与Meme币配对交易的叙事,试图创造新的投机标的。然而,数据显示Robinhood Chain上超过90%的用户活动仍集中在Meme币交易,真正的链上金融产品使用率很低。 当前各家平台的增长飞轮高度依赖链上的投机热度。一个关键的考验即将到来:Robinhood钱包的Gas费补贴将于9月底结束,届时交易成本上升可能导致交易量下滑。如果Meme热潮退去后用户流失,那么当前的竞争只是短期投机周期的份额争夺;但如果平台能成功将用户引导至借贷、股票代币等更广泛的金融业务,那么谁能控制这个入口将具有更长期的战略意义。

marsbit1 小時前

64 岁赚 9100%,Pons 掀起 Robinhood 混战

marsbit1 小時前

从纽约大学助教到白宫C位,Chainlink创始人没走过一步捷径

8月19日,白宫科技领袖峰会上,Chainlink创始人Sergey Nazarov站在特朗普身边就代币化对美国经济的影响发表讲话,彰显其行业地位。 Nazarov的成长路径贴近普通人:1986年生于苏联工程师家庭,童年喜爱拆装电器,培养了解决问题的思维。90年代随家人移民纽约。2007年从纽约大学哲学与管理专业毕业后,他进入风投机构FirstMark Capital,并在此结识了贵人Lawrence Lenihan,从基层逐步成长,同时担任其课程助教。期间他尝试首次创业,成立本地体验P2P平台ExistLocal Inc.积累经验。 此后他辞职专注创业,先成立风投机构QED Capital试图将纽约创投经验引入俄罗斯,但未达预期。同期他较早接触加密领域,曾租用GPU矿机挖比特币。2014年左右,他调整方向,在纽约先后尝试去中心化邮件项目CryptaMail、Secure Asset Exchange(SAE)及SmartContract(Chainlink前身)。SAE是一个理念超前的DeFi雏形,但因市场不成熟于2016年关停。 SmartContract则找准了方向,致力于解决智能合约连接外部数据的问题,即预言机技术。2016年,团队通过赢得SWIFT的行业竞赛并获得展示机会,打开了与传统金融机构合作的大门。2017年,他们演示了将外部利率数据接入合约并自动结算的方案,奠定了与SWIFT等机构长期合作的基础。如今,Chainlink已与众多顶尖金融机构建立合作,其价值在于切实提升了结算效率与自动化水平。 Nazarov的路径启示在于:进入优质环境积累认可、借助贵人拓展平台;勇于试错并从失败中发现真实需求;通过实力竞赛获得行业入场券;长期坚持解决实际问题而非空谈概念。这印证了行业中始终存在务实解决问题的建设者。

marsbit1 小時前

从纽约大学助教到白宫C位,Chainlink创始人没走过一步捷径

marsbit1 小時前

交易

現貨
活动图片