# Сопутствующие статьи по теме 3D

Новостной центр HTX предлагает последние статьи и углубленный анализ по "3D", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Покажи мне «Властелина колец»: Капати рекомендует новый бенчмарк для оценки больших моделей

Разработчик Андрей Карпати представил новый эталонный тест для больших языковых моделей (LLM) под названием «Властелин колец» («The Lord of the Rings Benchmark»). Тест призван заменить популярный ранее тест «Пеликан, едущий на велосипеде» (Pelican Riding a Bicycle SVG Test), который стал слишком простым для современных моделей. Новый тест заключается в том, чтобы модель на основе текстового описания начала романа «Властелин колец» (глава «Долгожданная вечеринка») создала интерактивную 3D-сцену с помощью библиотеки Three.js. Модель Anthropic Opus 5 справилась с задачей, сгенерировав около 5500 строк кода за 2 часа, используя примерно 1 миллион токенов. Получившаяся сцена, хотя и выглядит грубовато (напоминая раннюю 3D-анимацию), демонстрирует способность модели понимать пространственные отношения, описания объектов и преобразовывать нарратив в исполняемый код. Карпати и другие энтузиасты также протестировали другие модели, такие как DeepSeek-V4, результаты которых показали типичные для текущего уровня ошибки (например, парящие объекты). Ключевой вывод теста: современные LLM могут генерировать код и создавать сцены, но пока не способны «войти» в свой собственный мир для его проверки — например, запустить и протестировать созданную игру. Сообщество отреагировало множеством экспериментов: созданием 3D-модели Нью-Йорка, виртуального концерта Kanye West и даже прототипов игр. Это показывает, что новый тест не только оценивает пространственное мышление и долгосрочное планирование модели, но и открывает новые возможности для низкобюджетного создания прототипов интерактивного 3D-контента. Дискуссия вокруг теста поднимает вопросы: измеряет ли он принципиально новую «пространственную» способность или же это естественное расширение универсальных рассуждений LLM? И если модель сама может координировать создание сложных мультимедийных проектов (код, видео, аудио), то как это изменит роль специализированных инструментов для генерации контента?

marsbit2 дня назад 08:56

Покажи мне «Властелина колец»: Капати рекомендует новый бенчмарк для оценки больших моделей

marsbit2 дня назад 08:56

Claude Opus 5 пробился в сеть, появились первые практические тесты от пользователей

Claude Opus 5 досрочно попал в сеть, и пользователи уже провели первые тесты. Были опубликованы демонстрации, показывающие впечатляющие возможности модели в генерации сложных и детализированных 2D и 3D сцен. Например, сцена с катапультой, атакующей стену замка, содержала детализированные параметры, такие как натяжение и вес снаряда. В других тестах Opus 5 воссоздавал физику блоков в стиле Minecraft и генерировал фотореалистичные SVG-изображения, такие как геймпад PS5. Сравнение с текущей моделью Fable 5 на той же сцене с катапультой показало, что Opus 5 создает сцены с большей плотностью деталей и реализмом. Сообщество активно обсуждает, может ли Opus 5, цена которой в два раза ниже, стать полноценной заменой Fable 5. Однако первые отчеты указывают на очень высокое потребление токенов новой моделью, что может нивелировать ценовое преимущество. Утечки Opus 5 начались 9 июля, когда в инструменте Cursor появился и затем исчез таинственный вариант «Honeycomb EAP». Позже ссылки на модель были замечены в Google Vertex AI. 21 июля появились сообщения, что некоторые пользователи уже получили доступ к Opus 5, хотя интерфейс все еще показывает версию 4.8. Обнаружение строки «claude-opus-5-thinking-high» в ошибке Cursor указывает на скорый официальный выпуск модели. Итоговая стоимость использования и производительность станут ясны после полноценного релиза.

marsbit07/24 07:54

Claude Opus 5 пробился в сеть, появились первые практические тесты от пользователей

marsbit07/24 07:54

Всего 1600 строк кода создают подводный Манхэттен, Fable 5 шокировал Капарти

**Статья: «Fable 5 и 1600 строк кода создают подводный Манхэттен, потрясая Карпати»** Система Fable 5 от компании Fable демонстрирует прорывные возможности в генерации интерактивных 3D-миров на базе текстовых промптов. Энтузиаст Питер Гостав (Arena.ai) представил видео, в котором с помощью модели было создано 63 сложных 3D-сцены, преимущественно с использованием Three.js и за один проход. Наиболее впечатляющим примером стал детализированный подводный Манхэттен, сгенерированный всего 1600 строками кода. Среди других сцен — исторические города (Истанбул, Лондон), природные явления (извержение вулкана, водопад), «ожившие» полотна Ван Гога и Моне, в которые можно «войти», и симуляции (полёты, паркур). Андрей Карпати, недавно присоединившийся к команде предобучения в Anthropic, назвал результаты «невероятными» и ввёл термин «fablemaxxing», описывающий качественный скачок с каждым новым уровнем модели. Он отметил, что модель, обученная на интернет-данных, демонстрирует неожиданное понимание физики и повествования (например, рыба, вырывающаяся из пасти медведя). Гостав отмечает, что ключевая сложность для ИИ — не создание отдельных объектов, а согласованное управление множеством элементов в сцене. Хотя представленные работы были отобраны из большего числа сгенерированных (около 20% отбракованы), и игровые механики пока остаются слабым местом, способность модели с первого промпта создавать сложные, связные миры знаменует новый этап. Границы возможностей Fable 5 даже для её создателей до конца не ясны, и эта технология открывает новые горизонты для творчества и прикладных задач.

marsbit07/06 09:49

Всего 1600 строк кода создают подводный Манхэттен, Fable 5 шокировал Капарти

marsbit07/06 09:49

SemiAnalysis разбирает HiSilicon Kirin 9030: техпроцесс упёрся в стену, и чип решили сложить

Аналитическая фирма SemiAnalysis опубликовала первый публичный отчёт своего лабораторного подразделения STEEL с анализом процессора Kirin 9030 от Huawei, изготовленного по техпроцессу SMIC N+3. Отчёт отмечает, что SMIC удалось достичь плотности логических транзисторов (113.4 MTr/мм²), сопоставимой с TSMC N6, даже без использования литографии EUV. Однако это достижение потребовало применения более сложных и дорогих методов, таких как самонастраиваемая четверная паттернизация (SAQP), что негативно сказывается на стоимости и управлении выходом годных изделий. Производительность Kirin 9030 находится примерно на уровне флагманских чипов 2022 года, отставая от современных лидеров рынка в 2-3 раза. Основным сдерживающим фактором считается устаревшая производственная база. В отчёте также рассматривается перспективная стратегия Huawei по преодолению ограничений в техпроцессах. Компания исследует переход от традиционного масштабирования к «τ-масштабированию», которое фокусируется на сокращении временных задержек. Практическим воплощением этой стратегии является технология LogicFolding — вертикальное 3D-свёртывание логических блоков для сокращения критических путей сигнала и повышения производительности. Huawei ставит целью достичь частоты 5 ГГц и высокой эквивалентной плотности к 2031 году. Выводы SemiAnalysis указывают, что экспортные ограничения не остановили прогресс Китая в полупроводниковой сфере, но изменили его траекторию, сделав её более дорогой и сложной. При этом технологии и знания распространяются внутри китайской экосистемы, а такие направления, как 3D-интеграция и развитие отечественных EDA-инструментов, приобретают стратегическое значение для создания жизнеспособных продуктов в условиях санкций.

marsbit06/15 06:53

SemiAnalysis разбирает HiSilicon Kirin 9030: техпроцесс упёрся в стену, и чип решили сложить

marsbit06/15 06:53

После того, как IBM обратила на него внимание, three вырос в 50 раз

После того, как IBM выразила заинтересованность в сотрудничестве с проектом three.ws из экосистемы Solana, его токен THREE вырос на впечатляющие 5000%. Этот скачок произошел после публичных откликов IBM в социальных сетях на соответствующие сообщения проекта. Three.ws позиционирует себя как «3D-агентный слой» для интернета. Его цель — вывести AI-агентов из чатов и внутренних программ, превратив их в видимых, интерактивных 3D-персонажей, способных выполнять действия и совершать транзакции. Проект позволяет разработчикам легко встраивать таких агентов на веб-сайты. Технологическая структура three.ws состоит из четырех уровней: рендеринг (отображение 3D-модели), уровень агента (мозг, память, навыки), уровень идентичности (цифровой паспорт агента) и уровень интеграции (внедрение на сайты). Для коммерциализации three.ws активно интегрируется в корпоративные системы. Проект уже стал партнером AWS и представлен на AWS Marketplace, а сотрудничество с IBM направлено на интеграцию 3D-агентов с корпоративными ИИ-моделями Granite, облачными решениями и каналами сбыта IBM. Это должно превратить технологию из демонстрационной в управляемую корпоративную услугу. Хотя ажиотаж вокруг токена был вызван новостью об IBM, ключевой вопрос для проекта остается: насколько велика реальная потребность рынка в наделенных «телом» и цифровой идентичностью AI-агентах и какую роль в этой экосистеме будет играть токен THREE.

foresightnews_api06/05 04:28

После того, как IBM обратила на него внимание, three вырос в 50 раз

foresightnews_api06/05 04:28

three.ws объединяет усилия с Google Cloud: Браузерные 3D AI-агенты в блокчейне получают поддержку

three.ws, платформа с открытым исходным кодом, предоставляющая 3D-слой для ончейн-ИИ-агентов, объединяет усилия с Google Cloud для ускорения развития нового поколения олицетворенного, нативного для браузера искусственного интеллекта. Платформа позволяет выводить ИИ-агентов за пределы текстовых чатов, предоставляя им 3D-тело непосредственно в браузере — без плагинов, установок или загрузки на сервер. Разработчики могут загрузить любой аватар (GLB/glTF), подключить его к LLM (включая Claude от Anthropic), добавить долговременную память, эмоции в реальном времени и инструменты для действий. Агентов можно закрепить в блокчейне (как активы Metaplex Core на Solana или идентификаторы ERC-8004 в EVM), что дает им верифицируемое владение, кошельки и репутацию, переносимые между приложениями. three.ws также включает готовый сервер Model Context Protocol (MCP), официально зарегистрированный в реестре Anthropic, что позволяет ассистентам напрямую управлять 3D-аватарами и выполнять сложные действия с помощью естественного языка. Инфраструктура Google Cloud обеспечит необходимую вычислительную мощность для масштабирования, глобальный охват с низкой задержкой и надежную основу для предприятия. Платформа уже интегрирована в ряд экосистем, включая реестр MCP Anthropic, Alibaba Cloud Marketplace и BNB Chain DappBay, и является полностью открытой.

TheNewsCrypto05/27 13:10

three.ws объединяет усилия с Google Cloud: Браузерные 3D AI-агенты в блокчейне получают поддержку

TheNewsCrypto05/27 13:10

От одного обеденного стола до бесконечной вселенной: Ли Фэйфэй делает ставку на следующее измерение ИИ

**Ли Фэйфэй делает ставку на пространственный интеллект как новое измерение ИИ** Профессор Стэнфорда и основатель World Labs Ли Фэйфэй утверждает, что пространственный интеллект (Spatial Intelligence), а не только языковые модели, является следующим рубежом для искусственного интеллекта. Она подчеркивает, что эволюционно восприятие пространства и зрения, насчитывающее сотни миллионов лет, является более фундаментальным для понимания мира, чем относительно молодая человеческая речь. По ее мнению, языковые модели работают с «сжатой с потерей информации» версией реальности, в то время как истинное понимание требует способности воспринимать, рассуждать и взаимодействовать в трехмерном физическом мире. В качестве примера она приводит неспособность современных ИИ подсчитать стулья в видео или вывести законы физики из наблюдений, что легко дается человеку. Ее компания World Labs разрабатывает модель Marble, которая из текста, изображений или видео генерирует целые навигационные и интерактивные 3D-миры, а не просто видеоизображения. Хотя Marble значительно меньше по масштабу, чем крупнейшие языковые модели, она находит применение в игровой индустрии, кинопроизводстве (сокращая сроки в 40 раз), дизайне, тренировке роботов и даже создании терапевтических сред для лечения фобий. Ли Фэйфэй верит, что эта технология позволит создавать «бесконечные вселенные» для разных целей. Однако она призывает к взвешенному обсуждению будущего ИИ, избегая крайностей утопизма и апокалиптики, и считает, что успех технологии должен измеряться тем, делает ли она цивилизацию и жизнь каждого человека лучше, сохраняя человеческое достоинство.

marsbit05/27 00:15

От одного обеденного стола до бесконечной вселенной: Ли Фэйфэй делает ставку на следующее измерение ИИ

marsbit05/27 00:15

活动图片