Gemini 3.5 пришел! Этой ночью Google собственноручно победил Google

链捕手Опубликовано 2026-05-20Обновлено 2026-05-20

Введение

На Google I/O 2026 были представлены революционные достижения в области искусственного интеллекта. Главной новостью стал Gemini Omni — первая по-настоящему «универсальная» модель, способная создавать видео из любых комбинаций входных данных (текст, изображение, аудио, видео) с глубоким пониманием физического мира и возможностью последующего редактирования через чат. Параллельно был анонсирован Gemini 3.5 Flash, который по производительности и скорости превзошел предыдущий флагман 3.1 Pro и конкурентов. Он стал основой для Antigravity 2.0 — платформы для разработки агентов, продемонстрировавшей создание операционной системы силами 93 ИИ-агентов за 12 часов. Также представлен Gemini Spark — персональный ИИ-агент, работающий круглосуточно в облаке. Он интегрирован с сервисами Google (Gmail, Docs, Sheets) и может автономно выполнять сложные задачи, такие как планирование мероприятий или составление отчетов. Эти релизы в комплексе знаменуют новый этап, когда ИИ получает способность к полному пониманию, самостоятельному принятию решений и выполнению действий, приближая эру искусственного суперинтеллекта (ASI).

Автор: Новый Умственный Век

 

Конференция Google I/O 2026 выложилась на полную!

Только что, Пичай (Сундар Пичаи) и Демис Хассабис вышли на сцену вместе и вывалили все «большие козыри», которые копили последние полгода.

Без тени сомнения, главным героем этой ночи стал дебютировавший Gemini Omni!

Как по-настоящему «всеобъемлющая» большая модель, Omni может принимать ввод любого формата и генерировать любой контент. И с самого начала поддерживает вывод видео, что делает его «видеоверсией Nano Banana».

Еще одним кульминационным моментом вечера стал Gemini 3.5 Flash.

Практически во всех бенчмарках 3.5 Flash сокрушительно превзошел предыдущее флагманское семейство Gemini 3.1 Pro. Скорость вывода также удвоилась, что более чем в 4 раза быстрее, чем у GPT-5.5 и Opus 4.7. Более мощный 3.5 Pro будет выпущен в следующем месяце.

Кроме того, была представлена целая волна важных новинок:

  • Antigravity 2.0: новое независимое настольное приложение, эволюционировавшее из IDE в платформу для разработки агентов.

  • Gemini Spark: персональный AI-агент, работающий в облаке 24/7.

  • Ребрендинг приложения Gemini: кодовое название Neural Expressive, переход на расчет по вычислительным ресурсам.

  • Подписка AI Ultra: добавлена версия за 100 долларов, высший тариф снижен с 250 до 200 долларов.

  • Самое большое обновление Google Поиска за 25 лет: интеграция с 3.5 Flash, добавлена интеллектуальная строка поиска, автоматическая генерация мини-приложений и т.д.

    ......

Без преувеличения можно сказать, что плотность важной информации на этой конференции I/O стала самой высокой за все годы.

Премьера Gemini Omni: рождение «универсального» ИИ

Как и намекал промо-ролик, долгожданный Gemini Omni наконец-то прибыл. Хассабис лично вышел на сцену и объявил: «Мы делаем следующий важный шаг — Gemini Omni, это новая модель, способная создавать контент из любого ввода».

Такая солидная презентация говорит сама за себя. На этот раз Google стремится создать «универсальный» ИИ-движок для творчества. Он объединяет интеллект Gemini с самой мощной генеративной ИИ, достигая максимума в трех измерениях: понимание мира, многомодальность и редактирование. Проще говоря, получив любую комбинацию изображений, аудио, видео и текста, он может сгенерировать высококачественное видео. Более того, видео можно редактировать в режиме чата.

Что еще более важно, Omni не просто «выглядит как», он действительно понимает физический мир. Хассабис прямо сказал, что предыдущие системы часто терпели неудачу при моделировании таких понятий, как гравитация и кинетическая энергия, но Omni добился «скачкообразного изменения». Он внедрил «знания о мире» и «способность к рассуждению» Gemini в генерацию видео.

  • Дайте ему промпт «объяснить сворачивание белка с помощью глиняной анимации», и в сгенерированном видео каждый шаг сворачивания аминокислотной цепи в α-спираль и β-складку будет научно точным, а визуально это будет изящная покадровая анимация.

  • Или, например, подобрать объекты для каждой из 26 букв английского алфавита. C — капибара, D — диско-шар, L — лавовая лампа. Omni не просто склеивает материалы, он действительно связывает язык, изображения и семантику.

Надо сказать, что переход от реалистичности к осмысленности — это огромный шаг.

На сцене Хассабис достал селфи-видео и начал изменять его на лету. Нарисованный от руки круг на ладони превратился в черную дыру, улица для вечерней прогулки стала киберпанк-сценой. Одной фразой можно переписать изображение, одной фразой — изменить мир. Любой объект может стать холстом для создания новой реальности. Или, например, селфи с игрой огня на ладони, нарисованный на бумаге круг мгновенно становится черной дырой — возможны самые невероятные способы применения.

И это не одноразовая генерация. Можно продолжать диалог. Видео, сгенерированное Gemini Omni, сохраняет согласованность персонажей, физическую логичность и непрерывность запоминания сцены.

  • Начните с исходного кадра игры на скрипке. Второй раунд: «переместите скрипача в обстановку с этой картинки», приложив справочное изображение заснеженных гор и лугов. Сцена мгновенно меняется, движения и освещение адаптируются к новой среде.

  • Третий раунд: «переведите камеру за плечо скрипача». Перспектива вращается, но действие игры и музыка полностью непрерывны.

Как бы ни менялась сцена, основной объект изображения не распадется.

Еще более пугает гибкость ввода Omni. Изображения, текст, видео, аудио — любые справочные материалы можно смешивать и вводить, чтобы получить связный вывод. Можно даже создать свой собственный аватар, чтобы ИИ-версия вас появилась в любой сцене, говорила вашим голосом и делала то, что вы не делали.

В настоящее время Omni Flash официально запущен, а API-версия будет открыта в ближайшие недели. Более мощный Omni Pro также находится в разработке. Благодаря мощным интеграционным возможностям Google, Omni с самого начала интегрирован с приложением Gemini, Google Flow и YouTube Shorts, пользователи YouTube Shorts могут даже использовать его бесплатно.

Flash побеждает Pro: 3.5 переопределил понятие «флагман»

После Gemini Omni другим важным событием конференции I/O стал выпуск нового флагмана — Gemini 3.5 Flash. Google определяет его как самую мощную на сегодняшний день модель для программирования и агентов.

Лично Пичай объявил на сцене: «3.5 Flash превосходит Gemini 3.1 Pro практически во всех бенчмарках!» Примечательно, что 3.1 Pro — это флагманская модель, которую Google представил всего три месяца назад. А сейчас модель уровня Flash ее просто раздавила.

Неожиданно, что Google смог показать такие впечатляющие результаты за столь короткое время:

  • Terminal-Bench 2.1 (кодирование): 76.2%

  • GDPval-AA (задачи агентов в реальном мире): 1656 Elo

  • MCP Atlas (масштабное использование инструментов): 83.6%

  • CharXiv Reasoning (многомодальное понимание): 84.2%

В этих четырех основных бенчмарках 3.5 Flash совершил качественный скачок по сравнению с Gemini 3.1 Pro. По скорости 3.5 Flash занимает отдельную нишу: 289 токенов/сек, что более чем в 4 раза быстрее, чем у других передовых моделей. Кроме того, 3.5 Flash в некоторых бенчмарках сопоставим по производительности с GPT-5.5 и Claude Opus 4.7, а в некоторых случаях даже превосходит их. Нужно признать, 3.5 Flash быстр и силен, у него почти нет соперников.

Параметры абстрактны, лучше посмотреть на реальную демонстрацию возможностей. 3.5 Flash может за мгновение переварить заумную научную статью и написать визуализированный веб-сайт с идеальной интерактивностью. В задачах агентов, с помощью Antigravity, он может выполнять многошаговые рабочие процессы, автоматически классифицируя и называя ресурсы на доске. Или, используя двух агентов, всего за шесть часов воспроизвести статью AlphaZero и написать полноценно работающую игру.

93 агента создали ОС всего за 12 часов

Можно видеть, что все эти возможности 3.5 Flash реализуются с помощью новой Antigravity 2.0. Сегодня платформа для разработки агентов Google Antigravity обновилась до версии 2.0, превратившись из IDE в независимое настольное приложение, полностью ориентированное на дизайн для агентов.

Варун вышел на сцену и представил демонстрацию, от которой у всех затаилось дыхание. Он заставил Antigravity с 3.5 Flash с нуля построить операционную систему. 93 подчиненных агента работали параллельно, сделали более 15000 запросов к модели, обработали 2,6 миллиарда токенов, и через 12 часов полностью пустой проект превратился в полнофункциональное ядро ОС. Планировщик, управление памятью, файловая система — каждая строка кода была написана агентом, протестирована агентом и проверена агентом. Стоимость API составила менее 1000 долларов.

Затем он попытался запустить DOOM на этой написанной ИИ операционной системе. Первая попытка не удалась — не хватало видео- и драйверов клавиатуры. Тогда он тут же ввел команду на исправление в Antigravity 2.0, и агент начал автоматически дописывать код драйверов. Через некоторое время изображение DOOM появилось на экране, и зал взорвался аплодисментами.

Подведем итог: основные улучшения в Antigravity 2.0 включают:

  • Подчиненные агенты могут генерироваться динамически, главный агент разбивает задачу на подзадачи и распределяет их, и они выполняются параллельно, не мешая друг другу;

  • Управление асинхронными задачами позволяет длительным операциям не блокировать основной поток;

  • Запланированные задачи позволяют задавать «задачи по расписанию», чтобы агенты выполняли их автоматически, например, проверять статус PR раз в день, запускать скрипт проверки здоровья каждый час.

  • Новые команды со слэшем: /goal заставляет агента выполнить задачу одним махом, /grill-me наоборот, заставляет агента сначала разобраться с требованиями, прежде чем действовать, /browser явно управляет использованием браузера.

Однако это уже реализованные внутри компании возможности. Скорость обработки токенов в Google с помощью Antigravity в марте составляла 500 миллиардов в день. Сейчас она составляет ошеломляющие 3 триллиона в день. И эта ускоренная в 12 раз версия Flash доступна для использования в Antigravity с сегодняшнего дня.

3.5 Flash одновременно становится моделью по умолчанию для приложения Gemini и режима ИИ в Google Поиске, доступного для всех пользователей по всему миру. Разработчики могут обращаться к нему через Antigravity 2.0, Gemini API и Google AI Studio. Корпоративные пользователи получают доступ через платформу Gemini Enterprise Agent Platform. Еще более впечатляюще то, что 3.5 Pro сейчас проходит внутреннее тестирование и будет выпущен в следующем месяце.

Личный помощник 24/7: Google Spark наконец-то здесь

Третьим крупным релизом сегодняшнего вечера стал Gemini Spark! Пичай дал ему очень четкое определение: ваш личный агент ИИ. Он не останавливается даже тогда, когда вы закрываете ноутбук. Он работает на выделенной виртуальной машине в облаке, обеспечивая работу 24/7.

Gemini Spark работает на базе Gemini 3.5 + фреймворка Antigravity и глубоко интегрирован со всем «семейством» рабочих инструментов Google. Вице-президент по продукту Джош Вудворд вышел на сцену и продемонстрировал две сцены, которые привели в восторг весь зал.

  • Первая — рабочая сцена: введите команду «помогите мне составить черновик письма команде, суммирующего всю информацию о выпуске Gemini Live за прошлую неделю». Spark автоматически собирает информацию из Gmail, Документов, истории чатов, а также вызывает навык «ghostwriter», написанный самим Вудвордом, чтобы письмо автоматически соответствовало его личной манере речи. Весь процесс выполняется в фоновом режиме, человеку остается только проверить и отправить. Да, Spark поддерживает пользовательские навыки (skills), позволяя ему изучить вашу манеру речи, ваши предпочтения, ваш стиль работы.

  • Вторая — бытовая сцена: организация вечеринки в районе. Получив задание, Spark выполняет его шаг за шагом. Он создает таблицу для отслеживания ответов RSVP в Google Таблицах, напрямую подключенную к Gmail, и автоматически обновляет ее по мере поступления ответов. Для соседей, которые не откликнулись, Spark автоматически составляет напоминающее письмо, генерирует черновик и ждет подтверждения, прежде чем отправить его. Затем он также генерирует презентационную колоду в Google Slides, включая информацию о размещении надувного замка в районе. И все это без открытия ни одного приложения.

Более того, Spark обладает мощными возможностями голосового ввода. На сцене Вудворд достал телефон и прямо голосом отдал три задачи: «Найдите все встречи с Сундаром и пометьте их ярко-розовым цветом», «Напишите пригласительное письмо новому соседу Джону, чтобы добавить его в список участников вечеринки в районе», «Создайте документ со списком дел, которые нужно сделать для ребенка до конца учебного года, отсортированных по срокам».

Голос напрямую преобразовался в текстовые инструкции, а Spark автоматически разделил непрерывную речь на три независимые задачи, которые выполнялись параллельно в фоновом режиме.

Что касается ценообразования, подписка AI Ultra за 100 долларов в месяц дает доступ к Spark Beta. План высшего уровня Ultra снижен с 250 до 200 долларов. Spark на следующей неделе станет доступен для бета-тестирования сначала пользователям AI Ultra в США.

Этой ночью Google открыл дверь к ИСР

Оглядываясь на эту конференцию I/O, по-настоящему леденящим душу является не какой-то конкретный продукт. А то, что все возможности появились одновременно.

Полномодальное понимание, полномодальная генерация, круглосуточный онлайн-агент — эти три части пазла Google собрал за одну ночь. Omni превращает одну фразу в целый мир, не требуя от человека никаких материалов; 93 агента создают операционную систему с нуля, не требуя от человека написания ни одной строчки кода; Spark работает за вас 24/7, не требуя от человека открытия ни одного приложения.

Когда ИИ больше не нуждается в том, чтобы человек «скармливал» ему информацию, а сам понимает, сам принимает решения, сам выполняет, сам итеративно улучшается — конечная точка этого пути называется ИСР (Искусственный Суперинтеллект).

Никто не может дать точного графика. Но сегодняшняя конференция Google I/O заставила всех осознать одну вещь: на пути к суперинтеллекту больше нет препятствия под названием «технически невозможно». Осталось только скорость инженерного развертывания. Полгода назад мы еще спорили, не является ли ОИИ пузырем. Через полгода Google уже пишет операционные системы с помощью агентов. Ускорение в этой отрасли уже вышло за пределы того, что может воспринять человеческая интуиция.

Источники:

  • https://youtu.be/wYSncx9zLIU

  • https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5/

  • https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni/

  • https://antigravity.google/blog/introducing-google-antigravity-2-0

  • https://antigravity.google/blog/google-io-2026-feature-deep-dive

Редакторы: Таоцзы Моисей

 

 

 

 

 

 

 

 

 

 

 

 

Связанные с этим вопросы

QЧто такое Gemini Omni и чем он уникален?

AGemini Omni — это новая многомодальная модель от Google, представленная на I/O 2026. Её уникальность заключается в способности получать любой тип входных данных (текст, изображения, аудио, видео) и генерировать любой тип контента, включая высококачественные видео. Модель глубоко понимает физические законы мира (например, гравитацию), обеспечивает согласованность персонажей и сцен в видео и позволяет редактировать контент через чат.

QКаковы ключевые особенности и возможности Gemini 3.5 Flash?

AGemini 3.5 Flash — это новая высокоскоростная и мощная модель, которая по заявлению Google превосходит предыдущий флагман Gemini 3.1 Pro практически во всех бенчмарках. Она демонстрирует выдающиеся результаты в кодировании, задачах для агентов и многомодальном понимании. Её скорость генерации составляет 289 токенов в секунду, что более чем в 4 раза быстрее, чем у некоторых конкурентов. Модель уже интегрирована в продукты Google и доступна разработчикам.

QЧто представляет собой Antigravity 2.0 и какое достижение было продемонстрировано с его помощью?

AAntigravity 2.0 — это обновлённая платформа для разработки агентов, которая превратилась из IDE в самостоятельное настольное приложение. Её ключевая демонстрация на I/O 2026 заключалась в том, что 93 агента на базе Gemini 3.5 Flash, работая параллельно, за 12 часов создали с нуля функционирующее ядро операционной системы (с планировщиком, управлением памятью и файловой системой), а затем даже запустили на нём игру DOOM после автоматического исправления ошибок.

QКак работает персональный AI-агент Gemini Spark и какие задачи он может выполнять?

AGemini Spark — это персональный AI-агент, работающий 24/7 в облаке на выделенной виртуальной машине. Он работает на базе Gemini 3.5 и фреймворка Antigravity, глубоко интегрирован с сервисами Google (Gmail, Docs, Sheets и др.). Spark может выполнять сложные многоэтапные задачи, такие как сбор информации из разных источников для составления отчёта, планирование мероприятий (создание таблиц, рассылка писем, подготовка презентаций) и управление расписанием. Он также поддерживает голосовые команды и выполнение нескольких задач параллельно.

QКак, согласно статье, представленные на I/O 2026 технологии связаны с концепцией ASI (искусственного сверхинтеллекта)?

AВ статье утверждается, что представленные на I/O 2026 технологии — полноценное многомодальное понимание и генерация (Omni), способность агентов к сложной автономной разработке (Antigravity 2.0) и круглосуточные персональные агенты (Spark) — в совокупности устраняют ключевые технические барьеры на пути к ASI. Когда ИИ может самостоятельно понимать мир, принимать решения, выполнять действия и итеративно улучшать себя без постоянного вмешательства человека, это создаёт фундамент для возникновения сверхинтеллекта. Автор считает, что индустрия движется с такой скоростью, что вопрос теперь не в технической возможности, а в скорости инженерного развёртывания.

Похожее

ПОСЛЕДНИЕ НОВОСТИ: Дональд Трамп сделал резкое заявление по поводу Ирана! Он остановил атаки

Президент США Дональд Трамп заявил о приостановке запланированных масштабных военных действий против Ирана. Это решение было принято после обращения к нему Саудовской Аравии, ОАЭ, Катара и самого Ирана с просьбой предоставить время для дипломатических переговоров. Союзники в регионе полагают, что соглашение близко. Первоначальный этап переговоров будет сосредоточен на вопросах безопасности и возобновлении нормальной работы Ормузского пролива — ключевого маршрута для мировой нефтеторговли, чья безопасность критически важна для глобальных цен на энергоносители. После решения этих вопросов планируется начать переговоры по иранской ядерной программе. Новый раунд переговоров с Ираном начнётся завтра. В своём выступлении Трамп также коснулся темы валютного рынка, заявив, что США вмешались в поддержку японской иены, подчеркнув крепкие союзнические и взаимовыгодные экономические отношения с Японией.

cryptonews.ru37 мин. назад

ПОСЛЕДНИЕ НОВОСТИ: Дональд Трамп сделал резкое заявление по поводу Ирана! Он остановил атаки

cryptonews.ru37 мин. назад

Банк Италии не увидел системных преимуществ стейблкоинов в переводах

Исследование Банка Италии показало, что стейблкоины (на примере USDC) не демонстрируют устойчивых системных преимуществ в стоимости и скорости международных денежных переводов по сравнению с традиционными сервисами. Анализ транзакций на 200 USDC в 10 платежных коридорах (Италия — Бразилия, Аргентина, Япония, ОАЭ, ЮАР и др.) выявил, что финальная стоимость переводов варьировалась от 0,3% до почти 9%. Сроки исполнения колебались от менее 20 минут в коридорах с инфраструктурой мгновенных платежей до 1-2 рабочих дней в ее отсутствие. Ключевые издержки и задержки связаны не с комиссиями блокчейна, а с процессами конвертации в фиатные валюты и работой локальных платежных систем. Хотя в большинстве изучных направлений стоимость переводов со стейблкоинами была ниже среднемирового показателя в 6,65%, по сравнению с сервисом Wise преимущество наблюдалось только в трех из семи сопоставимых случаев. Авторы отмечают, что преимущества стейблкоинов могли бы быть более заметны, если бы их можно было напрямую тратить без конвертации. Также подчеркивается, что запретительное регулирование не устраняет спрос на стейблкоины, а излишне жесткие правила лишь усложняют их использование для розничных клиентов. В контексте исследования упоминается значительное снижение общей капитализации рынка стейблкоинов в июле.

cryptonews.ru1 ч. назад

Банк Италии не увидел системных преимуществ стейблкоинов в переводах

cryptonews.ru1 ч. назад

«Биткойн-бум» в разгаре: новое заявление Сэйлора вызвало спекуляции о покупках

Исполнительный председатель MicroStrategy Майкл Сэйлор 2 августа опубликовал сообщение «Bitcoin Drive engaged», что вызвало спекуляции о новой покупке биткойнов компанией. Его отчет показал, что резерв MicroStrategy составляет 843 775 BTC стоимостью около $53,25 млрд, со средней себестоимостью $75 653 и нереализованным убытком в $10,58 млрд. Ранее аналогичный сигнал предшествовал объявлению о пополнении долларового резерва. В то же время, реестр компании отразил две недавние продажи на общую сумму 3 588 BTC, сократив запасы. Эти продажи, согласно документам SEC, были проведены для финансирования выплат по привилегированным акциям. Неделей ранее компания не покупала биткойны, увеличив свой долларовый резерв примерно до $3,75 млрд. Финансовые риски остаются высокими после отчетности об операционном убытке в $8,33 млрд за второй квартал 2026 года. Ожидается, что обновление данных в понедельник покажет, означает ли сообщение Сэйлора возврат к накоплению биткойнов, поскольку компания балансирует между своими крупными запасами криптовалюты и растущими денежными обязательствами.

cryptonews.ru1 ч. назад

«Биткойн-бум» в разгаре: новое заявление Сэйлора вызвало спекуляции о покупках

cryptonews.ru1 ч. назад

Паттерн на графике биткоина «голоса и плечи» сулит подъём к $67,200

Несмотря на медленное снижение в начале августа, на графике биткоина формируется перевёрнутая разворотная модель «голова и плечи». Цена $BTC колеблется около $63,200, формируя правое плечо, что является основным поводом для краткосрочного оптимизма. Ключевой вопрос — хватит ли покупателям сил для рывка к уровню $67,200 для подтверждения разворота. В то же время в паре ETH/BTC уже пробито разворотное дно. Ethereum демонстрирует относительную силу, закрепился в восходящем тренде и движется к цели 0,0312, а против доллара тестирует уровень $1875, открывая путь к $2163. Эта ротация капитала в пользу ETH лишает биткоин объёма, необходимого для быстрого роста. Таким образом, ситуация для биткоина остаётся напряжённой: либо он в ближайшие дни последует примеру Ethereum и осуществит быстрый рост выше $67,200, либо, если атака на «шею» паттерна не состоится, медведи возьмут контроль и отправят цену к уровням поддержки $60,000 и $58,000.

cryptonews.ru1 ч. назад

Паттерн на графике биткоина «голоса и плечи» сулит подъём к $67,200

cryptonews.ru1 ч. назад

Акции компаний, занимающихся искусственным интеллектом, торгуются как «мемокоины», в то время как биткоин практически не меняет цены — обзор недели

В еженедельном обзоре рассматривается волатильность на рынках, вызванная распродажей в секторе ИИ и проблемами крупного хедж-фонда «Situational Awareness», что привело к значительным падениям на азиатских фондовых рынках. Акцентируется внимание на макроэкономических факторах, включая политику ФРС и интервенции Банка Японии. В криптосфере обсуждаются закрытие бирж BitMart и банкротство Storj Labs, трудности компаний вроде Coinbase, а также действия MicroStrategy по наращиванию резервов. Поднимаются темы инсайдерской торговли на Hyperliquid и отключения малопопулярных активов в Aave. Отдельно выделяется энтузиазм венчурных инвесторов вокруг Bittensor ($TAO). Завершается обзор серьёзным предупреждением об уязвимости аппаратных кошельков Coldcard, призывая пользователей к немедленным действиям и повышенной бдительности при самохранении активов.

cryptonews.ru1 ч. назад

Акции компаний, занимающихся искусственным интеллектом, торгуются как «мемокоины», в то время как биткоин практически не меняет цены — обзор недели

cryptonews.ru1 ч. назад

Торговля

Спот
活动图片