Трепещите, люди, ИИ продолжает ускоряться

marsbitОпубликовано 2026-06-13Обновлено 2026-06-13

Введение

Тревога, люди: ИИ продолжает ускоряться На конференции BAAI 2026 стало ясно, что ИИ стремительно развивается по всем направлениям: от моделей и софта до "железа", прокладывая путь из цифрового в физический мир. Ключевые тренды: 1. **Scaling Law в силе:** Закон масштабирования не исчерпан. Масштабирование параметров, синтетических данных и вычислительных мощностей продолжает улучшать большие языковые и мультимодальные модели. Одновременно с этим развивается AI Coding, позволяя ИИ в перспективе самостоятельно обновлять цифровые продукты — начинается этап самоэволюции. 2. **Мир как новая цель:** Следующая ключевая цель — создание "модели мира", способной понимать и предсказывать состояния физического мира. Технологические пути (языковые, пиксельные, 3D-центричные модели) еще не сходятся. По оценкам, на конвергенцию может уйти 3-5 лет. Институт BAAI представил свою разработку в этой области — универсальную базовую модель мира *Wujie·Physis-v0.1*. 3. **Агенты становятся полезнее:** ИИ-агенты переходят от стадии "работоспособности" к стадии "удобства". Появляются специализированные решения (например, для диагностики в кардиологии или для конспектирования встреч). Для повышения их эффективности критически важна отладка инженерных аспектов (Harness) — таких как уточнение задач, проверка и обратная связь, что определяет верхний предел возможностей агента. Итог: ИИ уже не просто инструмент, а фундаментальная сила, перестраивающая мир. Его развитие сосредоточено на двух фронтах: у...

Всё верно, ИИ продолжает ускоряться.


В 2016 году, спустя лишь год после взрыва популярности глубокого обучения, развитие практически остановилось. В 2026 году, после 4 лет бурного роста, большие модели по-прежнему не достигли своего предела.


На конференции BAAI 2026, журнал «Guangzhui Intelligent» увидел, как всё — от моделей, программного и аппаратного обеспечения до продуктов — работает над тем, чтобы ИИ вышел из цифрового мира в физический.


С одной стороны, Scaling Law стабильно работает, продвигая развитие больших языковых и мультимодальных моделей, и отрасль ИИ уже вступила в фазу погони за мировыми моделями. Однако пока не решены вопросы технических маршрутов, данных и другие, на исследование которых может потребоваться как минимум 3-5 лет.


С другой стороны, прорывы в области агентов ускоряют внедрение ИИ в реальные сценарии. По мере того как агенты достигают стадии пригодности к использованию, отрасль продвигает их применение в таких областях, как медицина, совещания и другие. Чтобы сделать агентов из «пригодных к использованию» в «удобные», ключевым становится взаимодействие программного и аппаратного обеспечения. На выставочной площадке конференции BAAI производители чипов заняли «половину территории». Присутствовали практически все ведущие отечественные ИИ-чипы.



«Мы находимся на новом историческом переломном моменте. Искусственный интеллект больше не просто инструмент для преобразования какой-либо отрасли, а становится базовой силой, перестраивающей мир. AI Coding, автономные агенты, самоэволюция моделей открывают новые возможности для ИИ и создания ИИ. Мировые модели, воплощённый интеллект и робототехника позволяют интеллекту распространяться из цифрового мира в физический», — сказал Ван Чжунюань, президент Института интеллектуальных источников (BAAI).


Что же происходит в этой волне перестройки «базовой силы»?


В первый день конференции BAAI присутствующие гости дали ответ: ИИ переходит от «умения болтать» к «умению работать». Scaling Law продолжается, мировая модель, техническое направление которой ещё не сходится, становится центром внимания следующего этапа, а интеллектуальные агенты уже начинают переходить от пригодности к удобству использования, и перед ними также стоит множество проблем, требующих оптимизации.


ИИ не только не достиг потолка в технологиях


но и научился самоэволюции


За последний год, по мере исчерпания высококачественных текстовых данных из интернета, в отрасли распространились пессимистичные настроения о том, что «Scaling Law (закон масштабирования) вот-вот достигнет пика».


На многих форумах конференции BAAI часто поднимался вопрос «уменьшилась ли выгода от Scaling Law», и несколько гостей отрицали это утверждение.


«Я всё ещё твёрдо верю, что Scaling Law ещё далёк от своего конца, — сказал Ван Хэ, основатель и технический директор Galaxy General. — Оглядываясь сегодня назад, Scaling Law не потерял силу, просто он стал более разнообразным».


Scaling продолжает играть свою роль в серии недавно выпущенных больших языковых моделей. Анализируя недавно выпущенную Anthropic модель Fable 5, Ло Фули из Xiaomi отметила, что эта сама модель является продуктом научного продвижения Scaling. Это результат масштабирования, полученного путём сочетания трёх измерений: масштаба параметров, синтетических данных и обучения с подкреплением.


«Мы предполагаем, что масштаб параметров самой Fable 5, вероятно, в несколько раз превышает масштаб самой большой на данный момент открытой модели. Кроме того, были вложены значительные вычислительные ресурсы в Test-Time Scaling (масштабирование во время вывода) или обучение с подкреплением. Также синтетические данные, генерируемые людьми и агентами, довели объём данных до нового уровня», — сказала Ло Фули.


В мультимодальной области улучшение производительности моделей благодаря Scaling также весьма значительно. Чжу Цзюнь, основатель и главный научный сотрудник Shengsu Technology, заявил, что качество данных, размер модели и крупномасштабное обучение — всё это способствует улучшению модели. На основе повышения способностей базовой модели понимание физических законов и 3D-сцен также становится более эффективным.


Пока Scaling продолжает действовать, с постепенным созреванием AI Coding и ускорением внедрения агентов становится очевидной тенденция самоэволюции ИИ, от написания кода до самостоятельного выполнения обновлений продукта.


«Основой цифрового мира человека в значительной степени является код. Прогресс AI Coding стал реальным и превратился в mainstream, что означает, что всё в цифровом мире постепенно может быть взято под контроль ИИ», — сказал Ван Чжунюань.


Как за рубежом, так и внутри страны стало нормой использование ИИ для выполнения обновлений продукта.


«Если модель определяет способности интеллектуального агента, то Harness определяет верхний предел этих способностей», — сказал Ли Цзинцю. «Сложность заключается в необходимости дальнейшего уточнения, проверки и обратной связи по проблемам на основе модели».


Например, если полагаться только на модель для понимания проблемы, её возможности будут ограничены. Задача Harness — доработать и обогатить простое однострочное указание пользователя, чтобы модель лучше поняла потребность. Для этого Harness должен проявить способность понимать намерения, а после получения задачи спроектировать последующий рабочий процесс и затем распределить выполнение модели. В этом процессе может потребоваться сочетание человеческого вмешательства и корректировки, а также проверка перед завершением задачи.


Мировая модель


Следующее ключевое поле битвы для больших моделей


Продвигаясь за границы цифрового мира, мировая модель стала следующим ключевым полем битвы для больших моделей.


«На данный момент ещё нет ни одной мировой модели, которая действительно заставляла бы чувствовать себя особенно впечатлённо, решая различные проблемы реального физического мира», — сказал Ван Чжунюань.


Для мировой модели, находящейся на начальной стадии развития, в отрасли пока нет полного консенсуса относительно технологий для мировых моделей. И в условиях, когда технические маршруты ещё не сходятся, есть ряд неотложных проблем. Например, в отношении данных Ван Чжунюань привёл пример: нужны ли видео данные, симуляционные данные или данные реального физического мира — методология и путь ещё не найдены.


На примере Galaxy General Ван Хэ на месте рассказал об их применении синтетических данных.


«До появления парадигмы WAM (World Action Model, мировая модель действий) мы в рамках парадигмы VLA сначала использовали синтетические данные и провели множество экспериментов с захватом объектов», — сказал Ван Хэ. «Мы доказали на 1 миллиарде кадров симуляционных данных: если вы масштабируете данные до такого уровня, вы можете полностью реализовать zero-shot (обучение без примеров). В реальном мире, дайте мне любую вещь, и я смогу её захватить».


Относительно развития мировых моделей Институт BAAI прогнозирует, что «потребуется как минимум ещё несколько лет», и следующие три-пять лет будут этапом постоянной эволюции и итерации мировых моделей.


За последние несколько лет в отрасли появились мировые модели с различными техническими маршрутами, и развитие каждого из них имеет свои особенности.


Что касается мультимодальных мировых моделей, Чжу Цзюнь отметил, что видео модели тесно связаны с мировыми моделями, поскольку мировая модель должна обладать тремя способностями: видеть и понимать состояние, предсказывать и действовать. Среди обучающих данных, доступных в настоящее время, наиболее связанными с мировой моделью являются именно видео данные.


В условиях дифференциации различных технических маршрутов и отсутствия отраслевого консенсуса Институт BAAI классифицировал мировые модели на четыре категории:


Первая категория — языко-ориентированные мировые модели, которые отображают другие модальности и способности в языковое пространство, включая большие языковые модели (LLM), VLM, VLA и т.д.;


Вторая категория — пиксель-ориентированные мировые модели. Генерация видео по сути является предсказанием следующего кадра, но модели генерации видео не равны мировым моделям, они связаны с ними. World Action Model (WAM), который может стать очень популярным в этом году, эволюционирует на основе пикселей;


Третья категория — мировые модели, ориентированные на трёхмерную структуру, включая простое трёхмерное моделирование мира;


Четвёртая категория — мировые модели, ориентированные на визуальное представление.



В настоящее время Институт BAAI исследует «пятый» путь — слияние языко-ориентированного и ориентированного на визуальное представление подходов, а именно латентное пространственное представление, которое эквивалентно сжатию текстовой, графической и другой информации в векторное пространство для представления различных состояний реального физического мира.


«Будущее единое моделирование латентного пространства будет не только визуальным пространством, а полимодальным латентным пространством, что, весьма вероятно, является следующим возможным путём для истинной мировой модели», — сказал Ван Чжунюань.


На конференции Институт BAAI представил разрабатываемую мировую модель — WuJie·Physis-v0.1, которая ориентирована на моделирование физического пространства и прогнозирование следующего физического состояния. Её позиционирование — первая в мире универсальная базовая модель мира, подчёркивающая четыре ключевые способности: «физическая корректность, причинно-следственная прослеживаемость действий, долгосрочная временная согласованность, универсальная обобщаемость».



В настоящее время модель ещё находится на стадии обучения, во второй половине года BAAI будет продолжать делиться прогрессом и откроет модель после завершения обучения.


От «пригодности» к «удобству»


Интеллектуальным агентам предстоит пройти ещё много барьеров


Со стороны моделей прогресс в мировых моделях способствует реализации физического ИИ; со стороны продуктов агенты становятся ключевым продуктом для внедрения ИИ в повседневную жизнь масс.


Начиная с 2025 года, названного «годом интеллектуальных агентов», уже появились некоторые впечатляющие продукты-агенты, наметились признаки взрывного роста, но неожиданной оказалась огромная популярность «лобстеров» в этом году.


По сравнению с прошлым годом, когда агенты ещё находились в состоянии исполнения, в этом году агенты явно стали более активными, лучше справляться с делами и могут помогать пользователям активно выполнять более сложные задачи.


На конференции BAAI этого года Институт также представил четырёх агентов, ориентированных на вертикальные области: первый в мире вспомогательный диагностический агент для кардиологической магнитно-резонансной томографии BAAI Cardiac Agent, который, объединяя мультимодальные возможности и профессиональные знания врачей, помогает в принятии решений; автономный исследовательский агент AREX, применяемый в научной сфере; агент SoulAgent, помогающий пользователям слушать совещания в реальном времени и фиксировать ключевые моменты; а также агент для обнаружения рисков, связанный с получением вредных белков.


Например, протестировав агента для прослушивания совещаний, журнал «Guangzhui Intelligent» оценил его способность резюмировать содержание различных совещаний. SoulAgent действительно сделал краткое резюме содержания совещания. Хотя оно не так полно, как протокол, но основные идеи верны. Этот агент хорошо подходит для ситуаций, когда время проведения секционных заседаний совпадает.



Однако в настоящее время в техническом плане у интеллектуальных агентов существует множество проблем, требующих дальнейшей оптимизации. Профессор Ан Ян из Наньянского технологического университета отметил, что для поддержания дальнейшего повышения способностей агентов наиболее важными на данный момент остаются аспекты, связанные с инженерией контекста, такие как Memory (память), оркестрация и т.д.


На форуме по интеллектуальным агентам термин Harness (буквально — упряжь, означает целый набор инженерных фреймворков или сред, построенных вокруг агента), который редко упоминался в прошлом году и стал очень популярным в этом, стал одним из часто упоминаемых ключевых слов.


«Если модель определяет способности интеллектуального агента, то Harness определяет верхний предел этих способностей», — сказал Ли Цзинцю. «Сложность заключается в необходимости дальнейшего уточнения, проверки и обратной связи по проблемам на основе модели».


Например, если полагаться только на модель для понимания проблемы, её возможности будут ограничены. Задача Harness — доработать и обогатить простое однострочное указание пользователя, чтобы модель лучше поняла потребность. Для этого Harness должен проявить способность понимать намерения, а после получения задачи спроектировать последующий рабочий процесс и затем распределить выполнение модели. В этом процессе может потребоваться сочетание человеческого вмешательства и корректировки, а также проверка перед завершением задачи.


Проще говоря, как настоящий личный помощник, каждый детальный шаг требует отработки продуктом для Harness, чтобы ещё больше повысить эффективность выполнения агента.


В настоящее время агенты находятся на начальной стадии развития. Можно预见, что у этой отрасли большой потенциал для прогресса. Как повышение способностей моделей, так и укрепление инженерных деталей будут способствовать дальнейшему улучшению работоспособности агентов.

Эта статья из WeChat Official Account: Guangzhui Intelligent , автор: Следит за передовыми технологиями

Трендовые криптовалюты

Связанные с этим вопросы

QЧто является ключевой темой статьи?

AКлючевая тема статьи — ускоренное развитие искусственного интеллекта, переход от моделей, которые "умеют говорить", к моделям, которые "умеют работать" (агентам), и стремление к созданию мировых моделей для интеграции ИИ в физический мир.

QКакова текущая ситуация с законом Scaling Law согласно статье?

AСтатья указывает, что закон Scaling Law (закон масштабирования) всё ещё действует и не достиг своего предела. Его проявление стало более разнообразным, продолжая улучшать производительность как больших языковых моделей, так и мультимодальных моделей.

QКакие основные направления развития мировых моделей (World Models) обсуждаются в статье?

AВ статье обсуждаются четыре основных направления мировых моделей: 1) ориентированные на язык, 2) ориентированные на пиксели, 3) ориентированные на трёхмерную структуру, 4) ориентированные на визуальные представления. Также упоминается пятый, исследуемый путь — слияние языкового и визуального подходов через моделирование в латентном пространстве.

QКакие примеры применения агентов (Agent) приведены в статье?

AВ статье приведены примеры применения агентов в различных областях: вспомогательный диагностический агент для кардиомагнитного резонанса (BAAI Cardiac Agent), автономный исследовательский агент (AREX), агент для прослушивания и обобщения совещаний (SoulAgent) и агент для обнаружения рисков, связанных с вредными белками.

QКакова роль Harness в развитии агентов (Agent) согласно статье?

AСогласно статье, Harness (инженерная инфраструктура или среда вокруг агента) играет ключевую роль в определении верхнего предела возможностей агента. Он отвечает за уточнение и понимание намерений пользователя, проектирование рабочего процесса, координацию выполнения задач моделями, а также за проверку и корректировку результатов, тем самым повышая надежность и эффективность агентов.

Похожее

Robinhood Chain привлекает ключевых игроков: какие сигналы посылает развертывание «Pools» от Uniswap?

8 августа стало известно, что децентрализованная биржа Uniswap разрабатывает платформу для запуска токенов под названием «Pools» в экосистеме Robinhood Chain. Платформа, доступная на pools.trade, пока находится в стадии подготовки. Этот шаг знаменует собой расширение функций Uniswap от просто инфраструктуры для торговли к платформе для выпуска активов. Pools, как ожидается, предложит два основных механизма запуска: «Crowd Launch» (четырехчасовой аукцион) и «Instant Launch» (использующий механизм кривой связывания), оба направленные на более справедливое и эффективное ценовое открытие. Выбор для развертывания на Robinhood Chain является стратегическим и направлен на привлечение более широкой аудитории розничных инвестторов, упрощая им доступ к DeFi. Это может усилить позиции Robinhood Chain как моста между традиционными финансами и Web3. В настоящее время на рынке наблюдается спекулятивная активность вокруг неофициальных токенов, использующих тематику Pools, но официальный запуск и детали еще предстоит подтвердить. В долгосрочной перспективе успех Pools может превратить Uniswap в ключевую операционную систему для выпуска активов в Web3, определяя новый этап конкуренции в инфраструктуре.

marsbit51 мин. назад

Robinhood Chain привлекает ключевых игроков: какие сигналы посылает развертывание «Pools» от Uniswap?

marsbit51 мин. назад

Сторонники обновления BIP-110 для биткоина подготовили план «на крайний случай», если предложение не будет принято: это может кардинально изменить стоимость BTC

Сторонники предложения BIP-110, направленного на временное ограничение хранения произвольных данных в транзакциях биткоина, подготовили резервный план на случай блокировки обновления майнерами. Разработчик Крис Гуида адаптировал код, позволяющий изменить алгоритм доказательства работы (Proof-of-Work) в Bitcoin Knots. Эта мера рассматривается как крайний вариант, если майнеры не поддержат активацию BIP-110. Инициатива BIP-110, также известная как «временный софтфорк с уменьшенным объемом данных», ужесточает правила для данных в транзакциях и рассчитана на срок около года. Гуида и другие сторонники, такие как Люк Дашджр и Механик, считают, что возможность смены алгоритма майнинга послужит сдерживающим фактором для майнеров и подчеркнет, что правила сети должны определяться операторами узлов, а не майнерами. В случае реализации резервного плана нынешние ASIC-майнеры могут потерять возможность генерировать блоки, что приведет к кардинальной перестройке сети. Однако на данный момент поддержка BIP-110 со стороны майнеров остается ограниченной, и данный сценарий рассматривается лишь как непредвиденная мера.

cryptonews.ru3 ч. назад

Сторонники обновления BIP-110 для биткоина подготовили план «на крайний случай», если предложение не будет принято: это может кардинально изменить стоимость BTC

cryptonews.ru3 ч. назад

Почему цена биткоина осталась устойчивой и не упала, несмотря на недавний крупный хакерский взлом? Вот в чем секрет

В интервью на канале «Волк со всех улиц» эксперты обсудили устойчивость биткоина после хакерской атаки на холодные кошельки на $100 млн. Аналитик Bitwise Райан Расмуссен отметил, что рынок созрел: теперь доминируют институциональные инвесторы, использующие ETF и регулируемые сервисы (Coinbase, Anchorage), поэтому инциденты с частными кошельками почти не влияют на общую ситуацию. Инвестдиректор Bitwise Мэтт Хоуган добавил, что рынок стал более устойчивым к негативным новостям благодаря институциональному капиталу, а оставшиеся инвесторы держат активы твердо. Гендиректор Arch Public Тиллман Холлоуэй констатировал «смену караула»: если раньше цену определяли майнеры и криптобиржи, теперь контроль у Уолл-стрит. Хоуган также указал на разрыв между пессимизмом в соцсетях и долгосрочными стратегиями крупных банков (Morgan Stanley, Wells Fargo, UBS), рассматривающих коррекции как возможность для покупки. Расмуссен отметил, что управляющие портфелями всё чаще включают криптоактивы, рекомендуя выделять на биткоин 1–6%, так как его интеграция в традиционные индексы снизила воспринимаемые риски.

cryptonews.ru4 ч. назад

Почему цена биткоина осталась устойчивой и не упала, несмотря на недавний крупный хакерский взлом? Вот в чем секрет

cryptonews.ru4 ч. назад

Основатель Aave решительно выступает против запланированных изменений в Ethereum: «Это может нанести значительный ущерб»

Основатель и CEO Aave Стани Кулечов выступил против предложения в сообществе Ethereum (EIP), направленного на ограничение доходов от стейкинга. Предложение предусматривает снижение доходности до 0%, если доля стейкингованных ETH превысит 50% от общего предложения. Кулечов утверждает, что это сделает доход непредсказуемым и нерентабельным, особенно для институциональных инвесторов, которые ценят стабильные денежные потоки. Это может привести к их уходу в альтернативные сети, нанеся ущерб внедрению Ethereum. Он также предупреждает, что такие изменения подорвут стратегии кредитования и получения дохода на основе ETH, сократят соответствующие рынки и ослабят привлекательность ETH как актива. Кулечов призвал тщательно оценивать влияние на DeFi, стейкинг и институциональное принятие, надеясь, что предложение не будет реализовано.

cryptonews.ru4 ч. назад

Основатель Aave решительно выступает против запланированных изменений в Ethereum: «Это может нанести значительный ущерб»

cryptonews.ru4 ч. назад

Акции майнера Bitdeer подскочили на более чем 12% на фоне соглашения на $4,7 млрд

Компания Bitdeer заключила 16-летнее соглашение об аренде оборудования на своем объекте в Норвегии с компанией Volta Tydal AS на сумму 4,7 млрд долларов. Речь идет о площадке в муниципалитете Тюдал общей мощностью 180 МВт, которую переоборудуют из майнинга криптоактивов для нужд сектора искусственного интеллекта. В рамках сделки дочерняя структура Bitdeer, Tydal Data Center AS, предоставит 121 МВт вычислительных мощностей, сконфигурированных с графическими процессорами Nvidia. Эти мощности предназначены для «ведущей ИИ-лаборатории», которой, по данным Bloomberg, является компания Anthropic. Соглашение предусматривает возможность продления еще на 8 лет, что в перспективе может принести Bitdeer общий доход около 8 млрд долларов за 24 года. На фоне этой новости курс акций Bitdeer вырос более чем на 12%. Как и другие крупные майнинговые компании, Bitdeer активно диверсифицирует бизнес в сферу ИИ, где использование электроэнергии для вычислений в настоящее время считается более выгодным.

cryptonews.ru5 ч. назад

Акции майнера Bitdeer подскочили на более чем 12% на фоне соглашения на $4,7 млрд

cryptonews.ru5 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片