# Сопутствующие статьи по теме Мультимодальный

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Мультимодальный", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Google официально объявляет войну

В 2026 году на конференции Google I/O компания представила ряд мощных инноваций, демонстрирующих её агрессивную стратегию в области искусственного интеллекта. Были анонсированы три ключевые разработки: Gemini 3.5 Flash, Gemini Omni Flash и новый AI-ассистент Spark. Gemini 3.5 Flash, несмотря на меньший размер, превзошёл более крупные модели в тестах на логику и кодирование благодаря передовым технологиям «экстремального дистиллирования знаний» и новой архитектуре MoE со 256 микро-экспертами. Это обеспечивает сверхнизкую задержку (TTFT менее 65 мс), что идеально для интеллектуальных агентов. Gemini Omni Flash — это нативная мультимодальная модель для видео, способная в реальном времени анализировать физический мир с задержкой всего 120 мс, превращая ИИ из чат-бота в практический инструмент помощи. Ассистент Spark, глубоко интегрированный в Android 17, получает прямой доступ к системным API, позволяя выполнять сложные задачи и управлять приложениями с помощью голосовых команд, упрощая взаимодействие с устройствами. Кроме того, Google представила умные очки как основное устройство для взаимодействия с ИИ, оснащённые лёгкими дисплеями, локальным чипом Gemini для мгновенной обработки и полной интеграцией с экосистемой. Компания также объявила, что месячная аудитория Gemini достигла 9 миллиардов пользователей, и радикально снизила цены на свои AI-сервисы (например, Gemini 3.5 Flash теперь стоит $0.02 за 1 млн токенов на вход). Это стало возможным благодаря вертикально интегрированной инфраструктуре (собственные TPU) и стратегии монетизации через рекламу и экосистему, а не через продажу API. Эти шаги представляют собой прямую атаку на чисто модельно-ориентированных конкурентов вроде OpenAI, ставя под вопрос их бизнес-модели, а также бросают вызов Apple, продвигая будущее с бесшовным, голосовым и визуальным взаимодействием, которое может уменьшить роль смартфонов.

链捕手05/21 13:50

Google официально объявляет войну

链捕手05/21 13:50

Gemini 3.5 пришел! Этой ночью Google собственноручно победил Google

На Google I/O 2026 были представлены революционные достижения в области искусственного интеллекта. Главной новостью стал Gemini Omni — первая по-настоящему «универсальная» модель, способная создавать видео из любых комбинаций входных данных (текст, изображение, аудио, видео) с глубоким пониманием физического мира и возможностью последующего редактирования через чат. Параллельно был анонсирован Gemini 3.5 Flash, который по производительности и скорости превзошел предыдущий флагман 3.1 Pro и конкурентов. Он стал основой для Antigravity 2.0 — платформы для разработки агентов, продемонстрировавшей создание операционной системы силами 93 ИИ-агентов за 12 часов. Также представлен Gemini Spark — персональный ИИ-агент, работающий круглосуточно в облаке. Он интегрирован с сервисами Google (Gmail, Docs, Sheets) и может автономно выполнять сложные задачи, такие как планирование мероприятий или составление отчетов. Эти релизы в комплексе знаменуют новый этап, когда ИИ получает способность к полному пониманию, самостоятельному принятию решений и выполнению действий, приближая эру искусственного суперинтеллекта (ASI).

链捕手05/20 06:59

Gemini 3.5 пришел! Этой ночью Google собственноручно победил Google

链捕手05/20 06:59

Тот, кто создал Kling, вернулся в Alibaba и создал нового темного коня

AI-видео генерациясындағы соңғы оқиғалар: OpenAI Sora-ны жауып, Seedance 2.0 авторлық құқық мәселелеріне тап болды. Бұл арада Alibaba жаңа HappyHorse-1.0 моделін шығарды, ол Artificial Analysis рейтингінде бірінші орынға шықты. Модельді 2025 жылы Alibaba-ға оралған Чжан Ди басқарды, ол бұрын Kuaishou-да AI әзірлеумен айналысқан. HappyHorse ашық бастапқы кодты ұсынады және мәтіннен бейнеге, суреттен бейнеге және көпмодалы генерацияны қолдайды. Ол коммерциялық пайдалануға арналған және жылдамдығымен (5 секундтық бейнені 38 секундта жасайды) және тиімділігімен көзге түседі. Alibaba үшін бұл модель сауда контентін жасауға, шағын саудагерлерге көмектесуге және платформадағы айналымды арттыруға бағытталған. Бейне генерацияны нақты бизнес сценарийлерде қолдану арқылы Alibaba бәсекелестерден айырылады.

marsbit04/13 05:12

Тот, кто создал Kling, вернулся в Alibaba и создал нового темного коня

marsbit04/13 05:12

Забрали «Счастливую Лошадь»: Alibaba расставляет «диаграмму Багуа» с помощью ИИ

Алибaba официально признала, что модель генерации видео HappyHorse ("Счастливая лошадь") разработана её инновационным подразделением ATH. Модель заняла первое место в рейтинге Artificial Analysis, набрав 1357 баллов, и превзошла конкурентов по качеству и синхронизации аудио и видео. HappyHorse способна генерировать 5-секундное HD-видео всего за 38 секунд, что может снизить затраты на производство на 50%. Это достижение стало частью более широкой стратегии Alibaba в области ИИ. В марте-апреле 2026 года компания выпустила три флагманские модели: Qwen3.5-Omni, Wan2.7-Image и Qwen3.6-Plus. Модель Qwen3.6-Plus побила мировой рекорд по количеству вызовов — 1,4 трлн токенов за день. Alibaba реструктуризировала свою ИИ-деятельность, создав подразделение ATH и Комитет по технологиям во главе с CEO У Юнмином. Компания инвестировала 380 млрд юаней в развитие облачных и ИИ-технологий и нарастила производство собственных GPU-чипов. Несмотря на уход некоторых ключевых исследователей, Alibaba продолжает агрессивно инвестировать в ИИ, стремясь трансформироваться из e-commerce гиганта в лидера в области искусственного интеллекта.

marsbit04/11 04:09

Забрали «Счастливую Лошадь»: Alibaba расставляет «диаграмму Багуа» с помощью ИИ

marsbit04/11 04:09

Первый большой язык от Ван Тао: Meta наконец-то вернулась за игровой стол

Мета представила свою первую модель Muse Spark, разработанную под руководством Александра Вана (Alexandr Wang), который присоединился к компании около десяти месяцев назад. Модель является частью серии Muse и предназначена для интеграции в продукты Meta, включая WhatsApp, Instagram и Facebook. Spark отличается компактностью и скоростью работы, но при этом способна решать сложные задачи в области науки, математики и здравоохранения. Ключевые особенности включают нативную многомодальность и режим «визуальной цепочки рассуждений», что позволяет модели анализировать визуальную информацию на более глубокого уровня. В тестах Muse Spark показала сильные результаты в медицинских и визуальных задачах, хотя в некоторых областях, таких как кодирование, ещё уступает конкурентам. Анонс модели положительно повлиял на акции Meta, которые выросли на 6,5%. Это первый шаг в стратегии Meta по постепенному усилению своих ИИ-моделей.

marsbit04/09 10:58

Первый большой язык от Ван Тао: Meta наконец-то вернулась за игровой стол

marsbit04/09 10:58

Только что: «Авокадо» Цукерберга за 14,3 миллиарда долларов вышло в свет, бросать вызов GPT-5.4, самый дорогой дебют китайца в Кремниевой долине

Корпорация Meta представила свою новую модель искусственного интеллекта — Muse Spark (кодовое название Avocado). Разработанная лабораторией MSL, модель позиционируется как «универсальный боец» с поддержкой мультимодальности, цепочек визуальных рассуждений и многозадачности. Muse Spark набрала 52 балла в тестах Artificial Analysis, значительно превзойдя предыдущую модель Meta, Llama 4 Maverick (18 баллов). Она демонстрирует сильные результаты в мультимодальных и медицинских задачах, хотя в программировании и сложных агентских сценариях пока уступает лидерам. Ключевая особенность — режим «Contemplating», где несколько агентов работают параллельно. Модель эффективно использует вычислительные ресурсы, потребляя значительно меньше токенов, чем конкуренты. Muse Spark уже доступна в meta.ai и скоро будет интегрирована в продукты Meta. Модель остаётся закрытой, но бесплатной для пользователей. Это первый крупный проект Meta Super Intelligence Lab под руководством Александр Ванга, созданной после инвестиций в $14.3 млрд в Scale AI.

marsbit04/09 07:52

Только что: «Авокадо» Цукерберга за 14,3 миллиарда долларов вышло в свет, бросать вызов GPT-5.4, самый дорогой дебют китайца в Кремниевой долине

marsbit04/09 07:52

Таинственная модель HappyHorse взлетела в рейтинге, принеся свежее дыхание в гонку генерации?

Загадочная модель HappyHorse-1.0 неожиданно возглавила рейтинг AI Video Arena платформы Artificial Analysis, обойдя таких гигантов, как Seedance 2.0 и другие коммерческие решения. Рейтинг основан на слепых пользовательских тестах (Elo), что делает его более объективным. Анализ языка интерфейса (китайский и кантонский выше английского) и названия, отсылающего к году Лошади, указал на китайское происхождение команды. Технический анализ показал, что HappyHorse, вероятно, является оптимизированной версией недавно открытой модели daVinci-MagiHuman (разработана совместно Shanghai Insitute of Intelligence и Sand.ai). Её архитектура — 15-миллиардный трансформер, объединяющий текст, видео и аудио в единый поток. Быстрый успех объясняется фокусом на генерации портретов и говорящих голов, которые доминируют в тестовых выборках. Однако модель требует мощного железа (H100), ограничена короткими клипами и сценами с одним персонажем. Несмотря на это, её успех сигнализирует о важном сдвиге: открытые модели впервые достигли качества, сопоставимого с коммерческими в слепых тестах. Это может ускорить развитие сообщества и предложить альтернативу для создателей, ценящих контроль и кастомизацию.

marsbit04/08 07:59

Таинственная модель HappyHorse взлетела в рейтинге, принеся свежее дыхание в гонку генерации?

marsbit04/08 07:59

Министерство промышленности и информатизации КНР запрашивает мнения по 121 отраслевому стандарту, включая «Протокол контекста моделей искусственного интеллекта»

Министерство промышленности и информатизации Китая официально опубликовало уведомление о вынесении на общественное обсуждение 121 отраслевого стандарта, включая «Требования к безопасности применения контекстного протокола моделей искусственного интеллекта». Данная инициатива знаменует ключевой шаг в стандартизации базовых протоколов ИИ и построении системы безопасности. Основное внимание уделяется безопасности применения контекстного протокола моделей (Model Context Protocol), целью которого является устранение рисков совместимости и защиты данных при мультимодальном взаимодействии, обработке длинных текстов и межплатформенном использовании больших моделей через стандартизированные технические требования.

marsbit03/26 03:33

Министерство промышленности и информатизации КНР запрашивает мнения по 121 отраслевому стандарту, включая «Протокол контекста моделей искусственного интеллекта»

marsbit03/26 03:33

Словарь AI-жаргона (март 2026 года), рекомендуется сохранить

Оригинальный автор Golem из Odaily представляет «Словарь AI-жаргона (март 2026)» — полезный ресурс для тех, кто хочет разобраться в базовых и продвинутых терминах искусственного интеллекта. Основные термины включают: LLM (большая языковая модель), AI Agent (интеллектуальный агент), Multimodal (мультимодальность), Prompt (промпт), Generative AI (генеративный ИИ), Token (токен), Context Window (контекстное окно), Memory (память), Training (обучение), Inference (вывод), Tool Use (использование инструментов), API (интерфейс). Продвинутые концепции: Transformer (архитектура трансформера), Attention (механизм внимания), Agentic Workflow (рабочий процесс на основе агентов), Subagents (под-агенты), Skills (навыки), Hallucination (галлюцинации ИИ), Latency (задержка), Guardrails (ограничители), Vibe Coding (интуитивное программирование), Parameters (параметры), Reasoning Model (модель рассуждений), MCP (протокол контекста модели), Fine-tuning (тонкая настройка), Distillation (дистилляция), RAG (извлечение-усиление-генерация), Grounding (привязка к данным), Embedding (векторное представление), Benchmark (бенчмарк). Статья подчеркивает важность понимания этих терминов для эффективной работы в сфере ИИ и рекомендует сохранить материал для будущего использования.

Odaily星球日报03/11 11:37

Словарь AI-жаргона (март 2026 года), рекомендуется сохранить

Odaily星球日报03/11 11:37

活动图片