1600代码造出水下曼哈顿, Fable 5让Karpathy看呆了

marsbit發佈於 2026-07-06更新於 2026-07-06

文章摘要

AI模型Fable 5近期重新上线,其强大的3D世界生成能力引发了广泛关注。AI评测平台Arena.ai的Peter Gostev利用该模型,仅用约1600行代码,便一次性生成了63个复杂且细节丰富的互动3D场景,涵盖城市景观、自然奇观、艺术名画再现、微观视角及科幻想象等多个主题。 其中最令人惊叹的包括一座沉于水下的曼哈顿,其建筑、街道纹理栩栩如生;以及将梵高《星空》、莫奈《睡莲》等名画解构成可穿梭飞行的三维空间。这些场景不仅视觉震撼,更展现出模型对物理交互、动态细节(如熊捕鱼时鱼的挣扎)的深层理解与跨模态生成能力。 著名AI研究员、刚加入Anthropic的Andrej Karpathy观看后深感震撼,认为模型在创造丰富、可玩世界方面实现了质的飞跃,并提出了“fablemaxxing”一词来形容这种突破。 Gostev指出,Fable 5的优势在于能协调海量元素一次性生成连贯世界,显著减少了调试时间。尽管其在复杂游戏性上仍有局限,部分生成结果需筛选,但其在Arena.ai的Agent Arena榜单上已以巨大优势登顶,证明了其强大的实际任务完成能力。 此次演示揭示了当前AI模型在空间理解与创造性构建方面的惊人进步。无论是开发者还是使用者,都可能发现过去模型无法完成、而新一代模型可以胜任的新领域。探索才刚刚开始。

【导读】Fable 5重新上线,Arena.ai的Gostev在一段视频中甩出63个3D世界,几乎都是一次成型。看了视频,就连刚加盟Anthropic预训练团队的Karpathy,也直呼没想到。

一头熊站在河边,一口咬住跃起的鲑鱼。

鱼在它嘴里拼命挣扎。

这个画面,直接把Andrej Karpathy看呆了。

他看完这一组3D视频后,在推文中说:

太不可思议了,我之前没意识到模型竟然能创造出如此精彩、丰富且可玩的世界。

还撂下一个新词:fablemaxxing。

这太美了,属于顶级的fablemaxxing!每一个新的模型层级,总会有一些全新的东西在质上实现飞跃并带来惊喜。

Karpathy今年5月刚加盟Anthropic,加入的正是预训练团队。

6月,Fable 5首发,三天后被美国出口管制一纸叫停,7月1日刚解禁。视频作者,是AI评测平台Arena.ai的Peter Gostev。

他用Fable 5一口气跑了63个高难度3D生成,几乎全是三维图形库(Three.js),多数一次成型。

一个多月前,想让AI一次成型造出能走进去玩的3D世界,还近乎天方夜谭。如今,Fable 5一口气能搓出63个。

于是,Gostev不由在视频中感慨:连实验室里的人,都还没完全搞清它能干什么。

1600行代码,一座活着的水下曼哈顿

先说视频中最令人印象深刻的那个。

整座曼哈顿沉在水下。中央公园、摩天楼、街道纹理,细节丰富到让人难以置信。

Gostev翻出代码一看:1600行。就这1600行,撑起了一座活着的水下之城。

Fable 5生成的曼哈顿,从Battery到Inwood整座岛尽收眼底,几万栋楼各有轮廓,全部由1600行代码撑起。(图源:Peter Gostev视频)

这样的世界,Gostev一共做了63个,分成6大主题。

在巨型3D世界里,横跨欧亚两岸的伊斯坦布尔、2000年变迁的伦敦、宏伟的金字塔、庞贝火山喷发、车流穿行的金门大桥,一一被搭了出来;

Fable 5一次成型的伊斯坦布尔,横跨欧亚、层叠入海。(图源:Peter Gostev视频)

Fable 5生成的可食用王国,一座糖果做的巧克力工厂。(图源:Peter Gostev视频)

能上手玩的场景,有纽约屋顶跑酷、把整座城拆着玩的物理游乐场、仪表盘一应俱全的飞行模拟。

最让人不可思议的,是走进世界名画。梵高星空、莫奈睡莲,一幅幅铺成可以穿行的3D世界。

还有一类是不可能的视角:一毫米高的蚂蚁在雨里打量花园,一睁眼就撞见一座金山。

Fable 5把视角压到一毫米高,草叶长成高耸的山峰。(图源:Peter Gostev视频)

自然奇观里,尼亚加拉大瀑布、萤火虫同步闪烁的森林,那条让Karpathy震撼的熊吃鲑鱼,就在此类。

最后,是元素与宇宙,被劈开的红海、正在诞生的火山岛、直插云霄的太空电梯。

Fable 5生成的红海从中劈开,人走进两道水墙之间。(图源:Peter Gostev视频)

在Gostev看来,单一场景好不好看,从来不是难点。难的是模型能不能同时管住海量元素,让它们彼此协调。

弱一点的模型,往往前80%做得像模像样,最后20%全线崩掉,剩下的debug时间反而更长。

你没法照抄一幅画,它得先看懂

如果说造城市还算有逻辑可依,那下面这批画,才是让Gostev一连说了好几个「难以置信」的。

梵高的《星空》。

你没法照抄这样一幅画,满画布厚颜料堆叠,一道道笔触卷成漩涡。

Fable 5的做法,是用一根根独立的线条,在三维空间里重新拼出那片星空,再让你飞进去,在漩涡之间穿行。

Fable 5把梵高《星空》拆成一根根立体线条,在三维空间里重拼,让你飞进旋动的星群与漩涡之间。(图源:Peter Gostev视频)

莫奈的睡莲、葛饰北斋的浪花,同样被「打开」成可以漫游的世界。

在Gostev看来,Fable这次特别擅长把一件事讲明白,能一边演示一边说清事情怎么运作。这种解释力,是他之前没料到的。

当然,这些世界并非「一句话」变出来的。

Gostev喂给模型的,是又长又细的规格文档,多数案例一次成型,也有一部分做了一到两轮微调。

真正的分水岭在于:过去要十几轮才磨得出的东西,现在一个HTML文件,多数一次就跑出来了。

魔法背后,也有短板

Gostev坦言,自己这批案例是筛过的。他生成的总量比展示的多出约两成,剔掉了有明显bug的,才留下这63个。

游戏,是它的弱项。

他坦言那几个能玩的场景,「玩30秒就腻」。有个罗马帝国的版本,他嫌太卡通。

更微妙的是,他觉得模型有时候像在偷懒、藏着实力,得反复催它更有野心,才肯拿出真本事。

Fable 5上线时,就在Arena.ai自家的Agent Arena榜上以史上最大优势登顶。

Arena.ai官方称,这份榜单衡量的,是模型在数百万次真实任务里真正把事干成的能力。

这场探索,才刚刚开始

再回到视频中那条狗熊捉鲑鱼的场景。

让Karpathy感到奇怪的是,鱼被咬住会挣扎,这样一个没人要求的细节,一个只从互联网学习的大模型,怎么就知道了这些?

知道了,又怎么把这份理解,翻译成xyz坐标、网格、变换、动画、效果、交互,乃至一个个微型故事?

这个问题,已经越过了「AI画得好不好」,落到了「它到底懂了多少」。

Karpathy还感慨道:再往上加一到三个模型层级,能造出什么,真是不敢想。

Gostev同样也惊叹于AI的快速发展,「别被半年前的模型框住了。你或许不在乎3D,但你手上一定有件事,是过去的模型干不了、而今天的它能干的。去试。」

连造模型的人,都还没摸到它的边界。

这场探索,才刚刚开始。

参考资料:

https://github.com/petergpt/3d-prompt-collection#prompt-01

https://x.com/karpathy/status/2073505440479293773

https://www.youtube.com/watch?v=rTc2_-1KuRE&t=14s

本文来自微信公众号“新智元”,作者:ASI启示录;编辑:元宇

相關問答

Q文章中提到,Fable 5 通过多少行代码生成了“水下曼哈顿”?

A1600行代码。

QAndrej Karpathy 在观看视频后,创造了哪个新词来形容 Fable 5 的表现?

A他创造的新词是“fablemaxxing”。

Q根据文章,Gostev 用 Fable 5 一共跑了多少个高难度的3D生成?

AGostev 用 Fable 5 一口气跑了63个高难度的3D生成。

QFable 5 在哪些类型的场景生成上表现出了令人印象深刻的能力?

AFable 5 在巨型3D城市、可漫游的名画(如梵高的《星空》)、自然奇观、物理游乐场、飞行模拟以及从微观视角(如一毫米高的蚂蚁)观察世界等多种场景生成上表现令人印象深刻。

Q文章中提到,Fable 5 的哪个领域表现相对较弱?

A游戏生成领域表现相对较弱,Gostev 坦言其生成的游戏场景“玩30秒就腻”。

你可能也喜歡

如何让自己变得让人工智能永远也无法取代

面对人工智能的冲击,许多人担心工作被取代。然而,真正的威胁在于个人对他人和系统的依赖,以及由此产生的“薪资奴役”——即为生存而从事无意义、枯燥的工作。摆脱这种困境的关键,不是抵制技术,而是成为拥有高自主性的“不可受雇”个体。 文章提出了成功抵御AI替代的五个核心要素:自主性(主动行动的能力)、品味(判断事物价值的经验)、说服力(让他人关注你工作的能力)、毅力(坚持并从错误中学习)和迭代(根据反馈持续改进)。这些能力无法仅通过理论学习获得,必须通过实践来培养。 要启动转变,首先要彻底改变环境,重塑身份认同。其次,应选择一个能获得真实、快速反馈的实践领域,例如创业。在众多技能中,内容创作(媒体)比编写代码更具优势,因为其价值是主观的,需要独特的审美和判断力,这正是AI目前难以完全复制的。 具体行动上,可以从三个步骤开始: 1. **挖掘原始素材**:反思自己长期痴迷的知识领域、轻松解决的难题或童年被压抑的兴趣,找到独特的个人经验。 2. **确立反向思考主轴**:找出你坚信但主流观点错误的地方,或行业内普遍忽视的“皇帝新衣”,形成独特的批判性视角。 3. **立即发布**:将前两步的思考融合,撰写并发布第一个核心内容(如帖子、视频),勇敢接受真实世界的反馈,并在此基础上持续学习和迭代。 最终,抵御AI的关键在于构建一份与自身身份深度契合的毕生事业,通过持续的内容创作和真实互动,建立无法被自动化取代的独特价值和影响力。行动,从今天发布第一个想法开始。

marsbit3 小時前

如何让自己变得让人工智能永远也无法取代

marsbit3 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

文章探讨了通过投掷骰子生成比特币钱包种子短语的安全方法及其现实挑战。核心观点如下: **1. 骰子提供物理熵源** 骰子结果由众多微小变量决定,理论上虽可预测,但实践中无法被攻击者复制或计算,从而提供高质量的随机性。每个六面骰子投掷约产生2.585比特熵,50次投掷即可满足典型12词助记词(128比特熵)的安全需求。 **2. Coldcard漏洞事件凸显手工熵源的价值** 近期Coldcard硬件钱包因固件漏洞导致其内部随机数生成器存在缺陷,致使约1128枚比特币被盗。但那些**完全**通过足量骰子投掷生成种子短语的用户未受此漏洞影响,因为他们的主密钥未使用有缺陷的生成器。 **3. 重要警示:手工种子并非万能保护** 安全研究员指出,即使用户使用骰子生成了安全的种子,若他们使用了Coldcard的其他功能(如生成纸钱包、克隆密钥、共享签名密钥、密码等),这些**衍生密钥**仍可能调用有漏洞的随机数生成器,从而存在风险。安全种子不保证设备生成的所有秘密都安全。 **4. 手工生成熵源的现实局限性** 尽管数学上可靠,但该方法对大多数用户并不友好: * **过程繁琐易错**:需投掷50-99次,精确记录,任何输入错误都会导致钱包完全不同。 * **引入新风险**:用户可能在记录、转换过程中泄露信息,或使用有偏的骰子/投掷方式。 * **用户体验差**:难以想象大规模推广需要用户手动投掷近百次骰子。安全措施需适应现实生活场景和普通用户的知识水平。 **5. 给用户的建议** 受影响的Coldcard用户应: * 更新固件至最新版。 * 检查是否使用过有漏洞的功能生成了次级密钥或密码,如有则需立即更换。 * 考虑采用多签方案,使用不同厂商的设备分散风险。 **结论**:手工投掷骰子生成熵源是技术娴熟用户的一个有效安全选项,但其过程复杂、容易出错,不适合作为主流用户的默认方法。长远目标是依赖安全、透明且无需专业知识的硬件/软件随机数生成方案。

cryptonews.ru6 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

cryptonews.ru6 小時前

交易

現貨
活动图片