# Сопутствующие статьи по теме Генерация изображений

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Генерация изображений", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Экстренный отзыв функции генерации изображений Nano Banana 2 в Google Earth!

В Google Earth экстренно отозвали функцию генерации изображений Nano Banana 2 после того, как пользователи менее чем за день "сломали" её, создавая неподобающий или абсурдный контент (например, исторические памятники в постапокалиптическом стиле). Функция, позволявшая накладывать сгенерированные ИИ изображения на реальные спутниковые снимки и 3D-ландшафты в Google Earth, была временно отключена для усиления защитных мер. Эта технология, названная "геопространственным закреплением" (Geospatial Grounding), использует текущий спутниковый вид, данные рельефа и камеры для создания изображений, которые реалистично вписываются в реальную географию. Она открывала новые возможности: визуализацию исторических мест, создание информационных графиков и предварительный просмотр архитектурных проектов в их реальном окружении. Однако недостатки, такие как отсутствие поддержки режима Street View и неточности в генерируемой информации, а также возможность злоупотреблений, вынудили Google отозвать функцию. Этот шаг подчеркивает стратегию Google по использованию своего уникального массива географических данных для создания нового типа "правдоподобной" AI-визуализации, в отличие от конкурентов, сосредоточенных только на эстетике изображений.

marsbit2 дня назад 03:57

Экстренный отзыв функции генерации изображений Nano Banana 2 в Google Earth!

marsbit2 дня назад 03:57

Возможно, это самая потрясающая картинка на WAIC в этом году!

Новая модель от SenseTime, SenseNova U1 Pro, была представлена на WAIC 2026. Её ключевые особенности — генерация изображений с собственным эскизированием, проектированием, проверкой и нативной поддержкой разрешения 8K. В отличие от моделей, требующих многочисленных попыток, U1 Pro ориентирована на готовый продукт. Она способна понимать цели, планировать, организовывать информацию, генерировать контент и вносить коррективы для конечной сдачи проекта. Тесты включали создание длинного изображения по теме 24 солнечных терминов, плаката для продвинутой лаборатории, иллюстрации древней архитектуры в стиле перегородчатой эмали и киноафиши коммерческого уровня. Модель демонстрирует умение организовывать сложную информацию, поддерживать последовательность и детализацию в крупных форматах. По аналогии с развитием AI в кодинге, U1 Pro представляет собой переход к системной генерации контента, где модель несёт ответственность за финальный результат, открывая новые возможности в визуальном дизайне.

marsbit07/19 02:40

Возможно, это самая потрясающая картинка на WAIC в этом году!

marsbit07/19 02:40

Маленький Зах «Манго» генерирует изображения лишь немного уступая GPT Image 2: ему не учили редактировать — он научился сам

Meta AI представила свою самую передовую модель генерации изображений Muse Image под кодовым названием «Манго». Она заняла второе место на платформе Arena, уступая только GPT Image 2 от OpenAI. Ключевой особенностью «Манго» является способность действовать как интеллектуальный агент: модель сама ищет информацию в интернете для работы с фактами, пишет и запускает код для создания точных диаграмм и QR-кодов, а главное — самостоятельно корректирует результат, если он её не устраивает. Это поведение не было запрограммировано явно, а «проявилось» в ходе обучения с подкреплением. Модель интегрирована с языковой моделью Muse Spark («Авокадо»), что позволяет им совместно планировать и выполнять сложные задачи. Например, в демо-версии они создали серию изображений кошки от детства до старости и упаковали их в веб-игру. Кроме того, Muse Image обладает уникальной функцией, использующей социальный граф Meta: пользователи могут @упоминать публичные аккаунты Instagram в подсказках, чтобы создавать изображения с людьми из их открытых фотографий. Эта функция включена по умолчанию, что уже вызвало вопросы о конфиденциальности. Muse Image уже доступна в Meta AI, Instagram и WhatsApp, а вскоре появится в других приложениях компании, охватывающих миллиарды пользователей. Все созданные изображения имеют невидимый водяной знак Content Seal для идентификации ИИ-контента, а Meta также выпустила публичный инструмент для проверки происхождения изображений. Одновременно был анонсирован превью-релиз видео-модели Muse Video, которая генерирует видео с синхронным звуком и заняла третье место в соответствующем рейтинге Arena.

marsbit07/08 10:40

Маленький Зах «Манго» генерирует изображения лишь немного уступая GPT Image 2: ему не учили редактировать — он научился сам

marsbit07/08 10:40

Выходит видео-версия Nano Banana: встроена мировая база знаний Gemini, оригинальная банановая генерация изображений занимает всего 4 секунды

Выпущены две новые мультимодальные модели от Google: Gemini Omni Flash и Nano Banana 2 Lite. Gemini Omni Flash, доступная через API, сочетает возможности Gemini по работе с текстом, изображениями и видео, позволяя генерировать и редактировать видео с использованием знаний о мире. Модель поддерживает диалоговое редактирование видео, работу с несколькими типами входных данных и синхронизацию текста с действием. Стоимость генерации — около 0,10 доллара за секунду видео. Nano Banana 2 Lite — это оптимизированная для скорости модель генерации изображений. Она создаёт изображение с разрешением 1K примерно за 4 секунды и стоит около 0,034 доллара за изображение, что делает её вдвое дешевле и в пять раз быстрее Nano Banana 2, сохраняя при этом качество рендеринга текста. Ключевая инновация — возможность совместного использования моделей в едином рабочем процессе. Пользователи могут быстро генерировать изображения с помощью Nano Banana 2 Lite, а затем немедленно использовать их в качестве основы для создания видео в Gemini Omni Flash. Google представил три демо-приложения, иллюстрирующих этот подход: «Anywhere» для создания туристических видео из фото, «Space Lift» для визуализации дизайна интерьера и «Omni product studio» для автоматической генерации рекламного контента для электронной коммерции. Эти разработки демонстрируют стратегию Google по внедрению мультимодального ИИ в практические, коммерчески жизнеспособные приложения, охватывающие такие области, как маркетинг, дизайн и развлечения, используя преимущества экосистемы Android для монетизации.

marsbit07/01 01:55

Выходит видео-версия Nano Banana: встроена мировая база знаний Gemini, оригинальная банановая генерация изображений занимает всего 4 секунды

marsbit07/01 01:55

活动图片