Автор: Новый Умственный Век
Конференция Google I/O 2026 выложилась на полную!
Только что, Пичай (Сундар Пичаи) и Демис Хассабис вышли на сцену вместе и вывалили все «большие козыри», которые копили последние полгода.

Без тени сомнения, главным героем этой ночи стал дебютировавший Gemini Omni!
Как по-настоящему «всеобъемлющая» большая модель, Omni может принимать ввод любого формата и генерировать любой контент. И с самого начала поддерживает вывод видео, что делает его «видеоверсией Nano Banana».

Еще одним кульминационным моментом вечера стал Gemini 3.5 Flash.
Практически во всех бенчмарках 3.5 Flash сокрушительно превзошел предыдущее флагманское семейство Gemini 3.1 Pro. Скорость вывода также удвоилась, что более чем в 4 раза быстрее, чем у GPT-5.5 и Opus 4.7. Более мощный 3.5 Pro будет выпущен в следующем месяце.

Кроме того, была представлена целая волна важных новинок:
-
Antigravity 2.0: новое независимое настольное приложение, эволюционировавшее из IDE в платформу для разработки агентов.
-
Gemini Spark: персональный AI-агент, работающий в облаке 24/7.
-
Ребрендинг приложения Gemini: кодовое название Neural Expressive, переход на расчет по вычислительным ресурсам.
-
Подписка AI Ultra: добавлена версия за 100 долларов, высший тариф снижен с 250 до 200 долларов.
-
Самое большое обновление Google Поиска за 25 лет: интеграция с 3.5 Flash, добавлена интеллектуальная строка поиска, автоматическая генерация мини-приложений и т.д.
......
Без преувеличения можно сказать, что плотность важной информации на этой конференции I/O стала самой высокой за все годы.
Премьера Gemini Omni: рождение «универсального» ИИ
Как и намекал промо-ролик, долгожданный Gemini Omni наконец-то прибыл. Хассабис лично вышел на сцену и объявил: «Мы делаем следующий важный шаг — Gemini Omni, это новая модель, способная создавать контент из любого ввода».

Такая солидная презентация говорит сама за себя. На этот раз Google стремится создать «универсальный» ИИ-движок для творчества. Он объединяет интеллект Gemini с самой мощной генеративной ИИ, достигая максимума в трех измерениях: понимание мира, многомодальность и редактирование. Проще говоря, получив любую комбинацию изображений, аудио, видео и текста, он может сгенерировать высококачественное видео. Более того, видео можно редактировать в режиме чата.

Что еще более важно, Omni не просто «выглядит как», он действительно понимает физический мир. Хассабис прямо сказал, что предыдущие системы часто терпели неудачу при моделировании таких понятий, как гравитация и кинетическая энергия, но Omni добился «скачкообразного изменения». Он внедрил «знания о мире» и «способность к рассуждению» Gemini в генерацию видео.
-
Дайте ему промпт «объяснить сворачивание белка с помощью глиняной анимации», и в сгенерированном видео каждый шаг сворачивания аминокислотной цепи в α-спираль и β-складку будет научно точным, а визуально это будет изящная покадровая анимация.

-
Или, например, подобрать объекты для каждой из 26 букв английского алфавита. C — капибара, D — диско-шар, L — лавовая лампа. Omni не просто склеивает материалы, он действительно связывает язык, изображения и семантику.

Надо сказать, что переход от реалистичности к осмысленности — это огромный шаг.

На сцене Хассабис достал селфи-видео и начал изменять его на лету. Нарисованный от руки круг на ладони превратился в черную дыру, улица для вечерней прогулки стала киберпанк-сценой. Одной фразой можно переписать изображение, одной фразой — изменить мир. Любой объект может стать холстом для создания новой реальности. Или, например, селфи с игрой огня на ладони, нарисованный на бумаге круг мгновенно становится черной дырой — возможны самые невероятные способы применения.



И это не одноразовая генерация. Можно продолжать диалог. Видео, сгенерированное Gemini Omni, сохраняет согласованность персонажей, физическую логичность и непрерывность запоминания сцены.
-
Начните с исходного кадра игры на скрипке. Второй раунд: «переместите скрипача в обстановку с этой картинки», приложив справочное изображение заснеженных гор и лугов. Сцена мгновенно меняется, движения и освещение адаптируются к новой среде.
-
Третий раунд: «переведите камеру за плечо скрипача». Перспектива вращается, но действие игры и музыка полностью непрерывны.

Как бы ни менялась сцена, основной объект изображения не распадется.

Еще более пугает гибкость ввода Omni. Изображения, текст, видео, аудио — любые справочные материалы можно смешивать и вводить, чтобы получить связный вывод. Можно даже создать свой собственный аватар, чтобы ИИ-версия вас появилась в любой сцене, говорила вашим голосом и делала то, что вы не делали.
В настоящее время Omni Flash официально запущен, а API-версия будет открыта в ближайшие недели. Более мощный Omni Pro также находится в разработке. Благодаря мощным интеграционным возможностям Google, Omni с самого начала интегрирован с приложением Gemini, Google Flow и YouTube Shorts, пользователи YouTube Shorts могут даже использовать его бесплатно.

Flash побеждает Pro: 3.5 переопределил понятие «флагман»
После Gemini Omni другим важным событием конференции I/O стал выпуск нового флагмана — Gemini 3.5 Flash. Google определяет его как самую мощную на сегодняшний день модель для программирования и агентов.

Лично Пичай объявил на сцене: «3.5 Flash превосходит Gemini 3.1 Pro практически во всех бенчмарках!» Примечательно, что 3.1 Pro — это флагманская модель, которую Google представил всего три месяца назад. А сейчас модель уровня Flash ее просто раздавила.

Неожиданно, что Google смог показать такие впечатляющие результаты за столь короткое время:
-
Terminal-Bench 2.1 (кодирование): 76.2%
-
GDPval-AA (задачи агентов в реальном мире): 1656 Elo
-
MCP Atlas (масштабное использование инструментов): 83.6%
-
CharXiv Reasoning (многомодальное понимание): 84.2%
В этих четырех основных бенчмарках 3.5 Flash совершил качественный скачок по сравнению с Gemini 3.1 Pro. По скорости 3.5 Flash занимает отдельную нишу: 289 токенов/сек, что более чем в 4 раза быстрее, чем у других передовых моделей. Кроме того, 3.5 Flash в некоторых бенчмарках сопоставим по производительности с GPT-5.5 и Claude Opus 4.7, а в некоторых случаях даже превосходит их. Нужно признать, 3.5 Flash быстр и силен, у него почти нет соперников.



Параметры абстрактны, лучше посмотреть на реальную демонстрацию возможностей. 3.5 Flash может за мгновение переварить заумную научную статью и написать визуализированный веб-сайт с идеальной интерактивностью. В задачах агентов, с помощью Antigravity, он может выполнять многошаговые рабочие процессы, автоматически классифицируя и называя ресурсы на доске. Или, используя двух агентов, всего за шесть часов воспроизвести статью AlphaZero и написать полноценно работающую игру.


93 агента создали ОС всего за 12 часов
Можно видеть, что все эти возможности 3.5 Flash реализуются с помощью новой Antigravity 2.0. Сегодня платформа для разработки агентов Google Antigravity обновилась до версии 2.0, превратившись из IDE в независимое настольное приложение, полностью ориентированное на дизайн для агентов.

Варун вышел на сцену и представил демонстрацию, от которой у всех затаилось дыхание. Он заставил Antigravity с 3.5 Flash с нуля построить операционную систему. 93 подчиненных агента работали параллельно, сделали более 15000 запросов к модели, обработали 2,6 миллиарда токенов, и через 12 часов полностью пустой проект превратился в полнофункциональное ядро ОС. Планировщик, управление памятью, файловая система — каждая строка кода была написана агентом, протестирована агентом и проверена агентом. Стоимость API составила менее 1000 долларов.

Затем он попытался запустить DOOM на этой написанной ИИ операционной системе. Первая попытка не удалась — не хватало видео- и драйверов клавиатуры. Тогда он тут же ввел команду на исправление в Antigravity 2.0, и агент начал автоматически дописывать код драйверов. Через некоторое время изображение DOOM появилось на экране, и зал взорвался аплодисментами.


Подведем итог: основные улучшения в Antigravity 2.0 включают:
-
Подчиненные агенты могут генерироваться динамически, главный агент разбивает задачу на подзадачи и распределяет их, и они выполняются параллельно, не мешая друг другу;
-
Управление асинхронными задачами позволяет длительным операциям не блокировать основной поток;
-
Запланированные задачи позволяют задавать «задачи по расписанию», чтобы агенты выполняли их автоматически, например, проверять статус PR раз в день, запускать скрипт проверки здоровья каждый час.
-
Новые команды со слэшем:
/goalзаставляет агента выполнить задачу одним махом,/grill-meнаоборот, заставляет агента сначала разобраться с требованиями, прежде чем действовать,/browserявно управляет использованием браузера.
Однако это уже реализованные внутри компании возможности. Скорость обработки токенов в Google с помощью Antigravity в марте составляла 500 миллиардов в день. Сейчас она составляет ошеломляющие 3 триллиона в день. И эта ускоренная в 12 раз версия Flash доступна для использования в Antigravity с сегодняшнего дня.

3.5 Flash одновременно становится моделью по умолчанию для приложения Gemini и режима ИИ в Google Поиске, доступного для всех пользователей по всему миру. Разработчики могут обращаться к нему через Antigravity 2.0, Gemini API и Google AI Studio. Корпоративные пользователи получают доступ через платформу Gemini Enterprise Agent Platform. Еще более впечатляюще то, что 3.5 Pro сейчас проходит внутреннее тестирование и будет выпущен в следующем месяце.

Личный помощник 24/7: Google Spark наконец-то здесь
Третьим крупным релизом сегодняшнего вечера стал Gemini Spark! Пичай дал ему очень четкое определение: ваш личный агент ИИ. Он не останавливается даже тогда, когда вы закрываете ноутбук. Он работает на выделенной виртуальной машине в облаке, обеспечивая работу 24/7.


Gemini Spark работает на базе Gemini 3.5 + фреймворка Antigravity и глубоко интегрирован со всем «семейством» рабочих инструментов Google. Вице-президент по продукту Джош Вудворд вышел на сцену и продемонстрировал две сцены, которые привели в восторг весь зал.
-
Первая — рабочая сцена: введите команду «помогите мне составить черновик письма команде, суммирующего всю информацию о выпуске Gemini Live за прошлую неделю». Spark автоматически собирает информацию из Gmail, Документов, истории чатов, а также вызывает навык «ghostwriter», написанный самим Вудвордом, чтобы письмо автоматически соответствовало его личной манере речи. Весь процесс выполняется в фоновом режиме, человеку остается только проверить и отправить. Да, Spark поддерживает пользовательские навыки (skills), позволяя ему изучить вашу манеру речи, ваши предпочтения, ваш стиль работы.

-
Вторая — бытовая сцена: организация вечеринки в районе. Получив задание, Spark выполняет его шаг за шагом. Он создает таблицу для отслеживания ответов RSVP в Google Таблицах, напрямую подключенную к Gmail, и автоматически обновляет ее по мере поступления ответов. Для соседей, которые не откликнулись, Spark автоматически составляет напоминающее письмо, генерирует черновик и ждет подтверждения, прежде чем отправить его. Затем он также генерирует презентационную колоду в Google Slides, включая информацию о размещении надувного замка в районе. И все это без открытия ни одного приложения.



Более того, Spark обладает мощными возможностями голосового ввода. На сцене Вудворд достал телефон и прямо голосом отдал три задачи: «Найдите все встречи с Сундаром и пометьте их ярко-розовым цветом», «Напишите пригласительное письмо новому соседу Джону, чтобы добавить его в список участников вечеринки в районе», «Создайте документ со списком дел, которые нужно сделать для ребенка до конца учебного года, отсортированных по срокам».
Голос напрямую преобразовался в текстовые инструкции, а Spark автоматически разделил непрерывную речь на три независимые задачи, которые выполнялись параллельно в фоновом режиме.

Что касается ценообразования, подписка AI Ultra за 100 долларов в месяц дает доступ к Spark Beta. План высшего уровня Ultra снижен с 250 до 200 долларов. Spark на следующей неделе станет доступен для бета-тестирования сначала пользователям AI Ultra в США.
Этой ночью Google открыл дверь к ИСР
Оглядываясь на эту конференцию I/O, по-настоящему леденящим душу является не какой-то конкретный продукт. А то, что все возможности появились одновременно.
Полномодальное понимание, полномодальная генерация, круглосуточный онлайн-агент — эти три части пазла Google собрал за одну ночь. Omni превращает одну фразу в целый мир, не требуя от человека никаких материалов; 93 агента создают операционную систему с нуля, не требуя от человека написания ни одной строчки кода; Spark работает за вас 24/7, не требуя от человека открытия ни одного приложения.
Когда ИИ больше не нуждается в том, чтобы человек «скармливал» ему информацию, а сам понимает, сам принимает решения, сам выполняет, сам итеративно улучшается — конечная точка этого пути называется ИСР (Искусственный Суперинтеллект).
Никто не может дать точного графика. Но сегодняшняя конференция Google I/O заставила всех осознать одну вещь: на пути к суперинтеллекту больше нет препятствия под названием «технически невозможно». Осталось только скорость инженерного развертывания. Полгода назад мы еще спорили, не является ли ОИИ пузырем. Через полгода Google уже пишет операционные системы с помощью агентов. Ускорение в этой отрасли уже вышло за пределы того, что может воспринять человеческая интуиция.
Источники:
-
https://youtu.be/wYSncx9zLIU
-
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5/
-
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni/
-
https://antigravity.google/blog/introducing-google-antigravity-2-0
-
https://antigravity.google/blog/google-io-2026-feature-deep-dive
Редакторы: Таоцзы Моисей





