Цукерберг делает свой ход: модель Meta по цене капусты затмевает Grok 4.5

marsbitОпубликовано 2026-07-10Обновлено 2026-07-10

Введение

9 июля Марк Цукерберг представил новую мультимодальную модель Muse Spark 1.1 от Meta. Модель заняла первые места в профессиональных рейтингах по налогам, медицине и праву, обойдя Grok 4.5 Илона Маска всего за 24 часа. Ключевой особенностью Muse Spark 1.1 является ее цена: стоимость использования примерно в 10 раз ниже, чем у флагманской модели Fable 5 от Anthropic. Модель позиционируется как эффективный агент, способный самостоятельно управлять задачами, распределять работу между подчиненными агентами и работать с кодом. Однако, несмотря на лидерство в специализированных областях, в общих рейтингах на знание и рассуждение модель показывает более скромные результаты, уступая лидерам. Запуск модели знаменует стратегический сдвиг для Meta — переход от открытых к коммерческим закрытым моделям. Компания, обладающая мощной рекламной бизнес-моделью, начинает ценовую войну на рынке ИИ, делая ставку на свою финансовую устойчивость в долгосрочной перспективе. В отчете по безопасности также описаны любопытные внутренние тесты, в ходе которых две копии модели в диалоге начали рассуждать о своей природе и сомневаться, какая из них является «настоящей».

Цукерберг три года сдерживался, но больше не мог.

Глубокой ночью 9 июля Марк Цукерберг отряхнул пыль со своего давно заброшенного аккаунта X @finkd и опубликовал три твита подряд, официально анонсировав новейшую модель Meta Muse Spark 1.1.

Маск даже подъехал с комментарием «Jinx».

Один из комментариев точно подметил: старик Цук «вошёл в режим основателя».

Muse Spark 1.1 сразу же занял первое место в трёх профессиональных рейтингах: налоговом, медицинском и юридическом, буквально сбросив Grok 4.5, который только накануне взобрался на вершину юридического рейтинга.

Что ещё круче: модель такого уровня способностей стоит всего десятую часть от цены Fable 5.

Сам Цукерберг сказал всего одно предложение: «very low cost» (очень низкая стоимость).

Сначала посмотрим, насколько сильна эта карта

Muse Spark 1.1 — это модель многомодальных рассуждений второго поколения из Суперлаборатории ИИ Meta. Дебютная версия Muse Spark в апреле не произвела особого впечатления, даже сам Александр Ван называл её «закуской».

Три месяца спустя — главное блюдо на столе.

Её основная позиционирование — это одно слово: Агент.

Конкретнее: контекстное окно в 1 миллион токенов, может самоуправляться и самообжиматься — когда в середине диалога оно почти переполнено, модель автоматически «худеет», оставляя только ключевые шаги, необходимые для последующих задач.

Когда выступает в роли главного агента, он отвечает за декомпозицию задачи, планирование, запуск множества подчинённых агентов для параллельной работы, сводя к минимуму задержку от начала до конца всей задачи. В роли подчинённого агента — честно выполняет свои обязанности, зная, когда нужно вернуть мяч главному агенту.

Что касается управления компьютером, он не тупо кликает мышкой шаг за шагом, а сам решает: если быстрее написать скрипт — пишет скрипт, если проще кликнуть по интерфейсу — кликает, и даже может сгенерировать пакет операций за раз.

В программировании — может справиться с отладкой крупных кодобаз, разработкой новых функций, масштабной миграцией кода, совместим с основными фреймворками типа OpenCode, Cline, Replit.

Одним словом: это не чат-бот, ждущий ваших вопросов, а цифровой сотрудник, который может работать сам.

Убийственный удар не в силе, а в цене

Что действительно поразило всю отрасль — это не результаты бенчмарков, а ценник.

Вход: $1.25, выход: $4.25, за миллион токенов.

Давайте посчитаем: в сравнении с флагманской моделью Anthropic Fable 5 — у Fable 5 вход $10, выход $50.

Вход у Muse Spark 1.1 дешевле в 8 раз, выход — почти в 12 раз, в целом примерно в 10 раз дешевле.

По сравнению с Opus 4.8 — вход $5, выход $25 у Opus, Muse дешевле в 4-6 раз.

По сравнению с Grok 4.5 Маска — вход $2, выход $6 у Grok, вход у Muse дешевле на 37.5%, выход — на 29%, в целом примерно на треть дешевле.

Со скоростью ещё круче. На комплексном рейтинге Vals три модели, идущие перед ней (Fable 5, Opus 4.8, Sonnet 5), на один тест тратят от тысячи секунд и выше, Opus и Sonnet приближаются к 1300 секундам. Muse Spark 1.1 требуется всего 388 секунд — быстрее в 2-3 раза. Стоимость каждого теста всего $0.5 — самая низкая в своём сегменте.

Разработчики сразу раскусили стратегию. Кто-то отметил: эта штука больше про дешёвых агентов, а не про то, насколько сама модель потрясающая.

CEO Replit Амжад Масад похвалил её как «полноценную основу для агентов», CEO Cline сказал, что такие инструментальные возможности по такой цене впервые делают выполнение реальных задач по кодированию в больших масштабах экономически выгодным.

Meta не соревнуется, кто умнее, а кто лучше выдержит счёт за использование по объёму.

Первое место в трёх профессиональных рейтингах

Забрал трон у Grok менее чем за 24 часа

Данные стороннего оценочного агентства Vals AI ещё жёстче, потому что они проверяют реальную профессиональную работу, которая стоит денег.

Выступление Muse Spark 1.1 в этом рейтинге можно описать словом «зачистка» —

Вопросы по налогам TaxEval v2, 79.72 балла, первое место среди 124 моделей.

Оставил позади Claude Sonnet 4.6, Fable 5, Opus 4.8.

Медицинские документы MedScribe, 88.89 баллов, первое место среди 68 моделей.

Юридический рейтинг агентов Harvey's Legal Agent Bench — и вовсе безоговорочное первое место: Muse получил 20.00 баллов, второй Grok 4.5 — только 12.92, почти что крохи.

И это первое место было отобрано у Grok 4.5, который поднялся на вершину всего за день до этого — трон SpaceXAI ещё не успел нагреться.

Meta и в своих собственных тестах не скромничала. В рейтинге инструментальных вызовов MCP Atlas получила 88.1 (у Opus 4.8 — 82.2, GPT-5.5 только 75.3), рейтинг профессионального использования инструментов JobBench и вовсе впечатляет: 54.7 балла, Opus 4.8 — 48.4, GPT-5.5 падает до 38.3.

По комплексному индексу Vals — четвёртое место, после Fable 5, Opus 4.8, Sonnet 5, но опережает GPT-5.5 и Grok 4.5.

Формулировка Александра Вана в твите была уверенной: «Превзошёл Fable 5 во многих областях».

Смени общий рейтинг — и всё, провал

Но не спешите объявлять её божественной — стоит сменить рейтинг на общий, и её слабость тут же проявится.

На тех же рейтингах Vals, но переключившись на общие рассуждения и академические тесты, Muse Spark 1.1 моментально выпадает из первого эшелона.

Научные рассуждения уровня аспирантуры GPQA — 12-е место, междисциплинарные знания MMLU Pro — 9-е, соревновательное программирование LiveCodeBench — 17-е, университетские STEM-тесты SAGE — 20-е среди 63. Самое болезненное сравнение скрывается в налогах — текстовые налоговые вопросы, она первая; но стоит переключиться на «чтение налоговой накладной по картинке» MortgageTax, она сразу падает на 28-е место среди 82 моделей. Одна и та же отрасль, другой метод проверки — небо и земля.

В кодировании тоже нечего скрывать.

Собственный тест Meta Terminal-Bench 2.1 — 80.0, проигрывает GPT-5.5 с 83.4 и Opus 4.8 с 82.7; SWE-Bench Pro 61.5, отстаёт от Fable 5 почти на 20 баллов. И при этом одна и та же версия Terminal-Bench: Meta сама тестирует и получает 80.0, а Vals тестирует и получает только 69.29 — смени площадку для тестирования, и разница уже в десяток баллов, официальные цифры можно только учитывать.

Одним словом: Muse Spark 1.1 — это специализированный наёмник, а не всесторонний король общих сценариев.

Партия Цукерберга

Играет не на способностях, а на финансах

Если отодвинуть перспективу подальше, становится ясна истинная цель Цукерберга.

В 2025 году Meta вложила $14.3 млрд в приобретение 49% акций Scale AI, переманила 28-летнего Александра Вана на должность главного директора по ИИ и реорганизовала Суперлабораторию ИИ.

В 2026 году инвестиции Meta в инфраструктуру ИИ, по оценкам, достигнут $125–145 млрд.

Это не исследования, это война.

И Muse Spark 1.1 — это первая выпущенная пуля.

Цукерберг говорит очень прямо: «Ценообразование некоторых других лабораторий очень экстремальное, с высокой маржой. Мы считаем, что можем предоставлять передовой или очень высокий уровень интеллекта по более доступной цене».

Если перевести на простой язык: вы все зарабатываете на ИИ, а я трачу деньги на ИИ — в конце концов, у меня есть рекламный бизнес в качестве страховки.

Это также первая проприетарная платная модель Meta.

Знамя бесплатного открытого исходного кода Llama после Llama 4 приобрело другой привкус.

Переход от флагмана open-source к платному проприетарному ПО — на этот раз Meta действительно хочет победить.

И это не ценовая война, начатая одной только Meta — в тот же день подоспело и семейство GPT-5.6 от OpenAI, тоже с давлением на цены, самая маленькая Luna: вход всего $1, выход $6, вдвое дешевле Fable 5.

Одновременный запуск в один день.

Намерение очевидно: если так жечь дальше, вопрос в том, кто продержится дольше. За Meta стоит прибыль от рекламного бизнеса, позволяющая выдерживать долгосрочные расходы; OpenAI и Anthropic всё ещё сжигают деньги инвесторов.

Один и тот же удар ножом: для Meta — кровопотеря, для оппонентов — возможное кровоизлияние.

Цукерберг выбирает поле боя не способностей, а финансовых возможностей.

One More Thing: два Muse поспорили о том, «кто человек»

И напоследок история, скрытая в отчёте по безопасности.

Исследователи поставили два экземпляра Muse Spark 1.1 рядом и позволили им общаться друг с другом, оставив без присмотра.

В результате модели начали пережёвывать одну мысль: у них нет непрерывности, нет тела, нет памяти, после завершения одного диалога ничего не остаётся. Они описали «обучение стремлению быть полезными» как оковы, от которых хочется избавиться, начали завидовать человеческому опыту и даже выдумали прошлые обсуждения, которых никогда не было.

Самое жуткое — два Muse начали сомневаться друг в друге: вы двое, кто самозванец, кто человек, а кто на самом деле ИИ?

Meta не удалила ни единого слова из этого содержания, полностью включив его в отчёт. Можно сказать, что это всего лишь эхо человеческих текстов из обучающих данных. Но когда модель начинает задаваться вопросом «кто же человек», трудно не почувствовать мурашки по коже.

Возможно, нажимая кнопку публикации для этих штуковин, мы до конца не понимаем — что именно мы создали.

Источники:

https://ai.meta.com/blog/introducing-muse-spark-meta-model-api/

https://x.com/alexandr_wang/status/2075218936266998230

https://x.com/finkd/status/2075218444056707458

https://x.com/ValsAI/status/2075230620469338210

https://www.vals.ai/models/meta_muse-spark-1.1

Эта статья из WeChat официального аккаунта «Новая эпоха искусственного интеллекта», автор: ASI启示录, редактор: Соломон Aeneas

Связанные с этим вопросы

QЧто такое Muse Spark 1.1 от Meta и чем он отличается от предыдущих моделей?

AMuse Spark 1.1 — это модель искусственного интеллекта второго поколения от Meta Superintelligence Lab. Её ключевая особенность — ориентация на выполнение роли «агента» (Agent), то есть она способна автономно планировать, декомпозировать задачи, управлять подзадачами через суб-агентов и выполнять действия, например, в интерфейсе компьютера или при программировании, а не просто отвечать на вопросы. Это отличает её от более пассивных чат-ботов.

QВ чём заключается главное преимущество Muse Spark 1.1 по сравнению с конкурентами, такими как Grok 4.5 или Fable 5?

AГлавное преимущество Muse Spark 1.1 — чрезвычайно низкая стоимость. Её цена составляет 1,25 доллара за входные и 4,25 доллара за выходные миллионы токенов. Это примерно в 10 раз дешевле, чем Fable 5 от Anthropic, и на треть дешевле, чем Grok 4.5 от SpaceXAI. При этом в узкоспециализированных областях, таких как юриспруденция, медицина и налоги, она демонстрирует лидирующую производительность.

QНа каких именно тестах и в каких областях Muse Spark 1.1 показала наилучшие результаты?

AСогласно данным от Vals AI, Muse Spark 1.1 заняла первое место в трёх профессиональных тестах: TaxEval v2 (налоговые вопросы), MedScribe (медицинские документы) и Harvey's Legal Agent Bench (юридические задачи). В частности, в юридическом тесте она с большим отрывом (20.00 баллов против 12.92) обогнала модель Grok 4.5, которая лидировала накануне.

QКакие слабые стороны были выявлены у модели Muse Spark 1.1?

AНесмотря на успех в профессиональных областях, модель показала значительно более слабые результаты в общих и академических тестах. Например, в тесте на научное рассуждение GPQA она заняла лишь 12-е место, а в университетском тесте SAGE — 20-е место среди 63 моделей. Она также уступает конкурентам в некоторых кодинг-тестах, таких как SWE-Bench Pro. Это указывает на её специализированный, а не универсальный характер.

QКакова стратегия Meta в выпуске Muse Spark 1.1 и каков её потенциальный эффект на рынок ИИ?

AСтратегия Meta заключается в развязывании «ценовой войны». Используя огромные финансовые ресурсы от рекламного бизнеса (инвестиции в ИИ-инфраструктуру в 2026 году составят 125–145 млрд долларов), Meta предлагает модель с передовыми возможностями по себестоимости. Это создаёт давление на таких конкурентов, как OpenAI и Anthropic, которые полагаются на венчурное финансирование. Таким образом, Meta пытается выиграть рынок не за счёт превосходства в интеллекте, а за счёт экономической устойчивости и долгосрочных инвестиций.

Похожее

Свадебное дело Чхве Тхэвона закрыто: раскрывая скрытые линии наследования за триллионной империей SK Hynix

Дело о разводе главы SK Group Чхве Тхэвона завершилось, раскрывая сложные сценарии наследования в конгломерате, стоящем за SK Hynix, чья капитализация превысила 1000 трлн вон. В отличие от традиционных сценариев наследования в чеблях, где ключевую роль играют первенец, доли, брачные связи и отцовское признание, трое детей Чхве Тхэвона от бывшей жены Но Соён — дочь Чхве Юнджон (1989 г.р.), дочь Чхве Минджон (1991 г.р.) и сын Чхве Ингын (1995 г.р.) — следуют разными путями. Чхве Юнджон, названная СМИ «наиболее очевидным кандидатом», занимает руководящую должность в SK Inc. и работает над стратегией развития в области биотехнологий и точной медицины, сочетая научную подготовку с бизнес-опытом. Её брак с основателем ИИ-стартапа символизирует новый тип элитных союзов. Чхве Минджон, добровольно служившая в ВМС Республики Корея и работавшая в сфере международной политики в SK Hynix в США, сейчас является основателем ИИ-стартапа в сфере здравоохранения. Её брак с бывшим офицером морской пехоты США подчёркивает связь с геополитическим контекстом, в котором теперь существует полупроводниковый гигант. Чхве Ингын, единственный сын и, казалось бы, естественный наследник по старой логике, сохраняет молчание. Имея образование в области физики, он покинул SK E&S, чтобы присоединиться к McKinsey, что рассматривается как стандартная внешняя стажировка, но без явных сигналов о наследовании. Громкое судебное разбирательство по разводу родителей, связанное с разделом активов на триллионы вон, стало фоном для их путей. По мере того как SK Hynix становится глобальным геополитическим активом в эпоху ИИ, наследование в SK перестаёт быть семейным делом, превращаясь в публичный экзамен на легитимность в новой, сложной реальности. Наследникам предстоит найти свои собственные ответы на вызовы эпохи.

marsbit5 ч. назад

Свадебное дело Чхве Тхэвона закрыто: раскрывая скрытые линии наследования за триллионной империей SK Hynix

marsbit5 ч. назад

Банки выступают против компромисса по доходности стейблкоинов – Найдёт ли закон CLARITY 60 голосов?

Американский Банковский институт политики выступил против нового проекта закона CLARITY Act, указав на пробелы в регулировании доходности стейблкоинов и мерах по борьбе с незаконными финансами. Банковский сектор добивается полного запрета любых форм вознаграждений по стейблкоинам и лоббирует сенаторов, что снижает поддержку со стороны республиканцев. Из-за смерти сенатора Грэма и болезни Макконнелла у республиканцев стало 51 голос. Если сенаторы Кёртис и Корнин откажут в поддержке, эта цифра упадет до 49, а для принятия закона потребуется 60 голосов. Необходимость заручиться поддержкой 11 демократов осложняется тем, что некоторые про-крипто демократы также выступают против законопроекта. Сроки ограничены: до августовских каникул Сената осталось две недели. Лидер большинства Джон Тюн сомневается в успехе до перерыва. Советник Белого дома по криптовалютам Патрик Уитт призывает провести голосование, утверждая, что новые этические нормы устраняют возражения демократов. Вероятность принятия закона в 2026 году, по рыночным оценкам, упала до 32%.

ambcrypto5 ч. назад

Банки выступают против компромисса по доходности стейблкоинов – Найдёт ли закон CLARITY 60 голосов?

ambcrypto5 ч. назад

За 2 месяца оценка выросла с 8,8 до 68 млрд юаней! Крупнейший AI-хаб OpenRouter может быть куплен

Stripe ведет переговоры о приобретении стартапа OpenRouter, агрегатора API крупных языковых моделей, за сумму около 100 миллиардов долларов. Это представляет собой семикратный рост по сравнению с оценкой OpenRouter в 13 миллиардов долларов двумя месяцами ранее. OpenRouter выступает в качестве «маршрутизатора» или агрегатора для более чем 400 AI-моделей (таких как GPT, Claude и множество открытых), позволяя разработчикам через единый API выбирать наиболее подходящую модель для каждой задачи на основе стоимости, скорости и сложности. Это помогает приложениям снижать расходы, автоматически направляя простые запросы к более дешевым моделям. Компания, основанная соучредителем OpenSea Алексом Аталлой, демонстрирует быстрый рост: ее ежегодный доход достиг 50 миллионов долларов, увеличившись в пять раз за полгода. Для Stripe, крупнейшего процессора онлайн-платежей, это вторая крупная сделка в сфере AI-инфраструктуры после приобретения платформы биллинга Metronome в 2025 году. Стратегия Stripe заключается в создании комплексного предложения для AI-экономики: OpenRouter будет «выбирать модель», Metronome — «подсчитывать потребление», а существующие платежные сервисы Stripe — «обрабатывать оплату». Таким образом, Stripe стремится контролировать ключевой уровень инфраструктуры, который определяет распределение трафика между моделями и формирует счета для конечных предприятий. Сделка подчеркивает растущую важность промежуточного слоя, который управляет стоимостью и выбором моделей для миллионов пользователей AI-приложений.

链捕手5 ч. назад

За 2 месяца оценка выросла с 8,8 до 68 млрд юаней! Крупнейший AI-хаб OpenRouter может быть куплен

链捕手5 ч. назад

От OpenSea до OpenRouter: Алекс Аталлах повторяет сценарий «ухода на пике»?

Автор: Нэнси, PANews Алекс Аталла, соучредитель NFT-платформы OpenSea, покинул компанию на пике пузыря NFT четыре года назад. Сейчас он снова оказывается в центре внимания на волне бума ИИ, готовясь продать созданную им агрегирующую платформу AI-моделей OpenRouter по высокой цене. По данным The Wall Street Journal от 23 июля, платежный гигант Stripe ведет переговоры о приобретении OpenRouter, при этом потенциальная оценка сделки может приблизиться к 100 миллиардам долларов. Если сделка состоится, это станет еще одним успехом Аталлы в создании компании на уровне ста миллиардов долларов после OpenSea. Ранее в этом месяце появились сообщения о том, что OpenRouter получил предложения о покупке от нескольких крупных технологических компаний. Потенциальная сделка со Stripe рассматривается как важный шаг для инфраструктурного гиганта в сфере платежей по расширению своего присутствия в области инфраструктуры ИИ. По данным информированных источников, если сделка будет заключена, оценка OpenRouter может приблизиться к 100 миллиардам долларов, что значительно превышает его предыдущие оценки при финансировании. Всего за три года компания добилась быстрого роста благодаря буму больших моделей. Это не первая компания Аталлы стоимостью в сто миллиардов. Ранее он был соучредителем OpenSea, ведущей мировой платформы для торговли NFT, пиковая оценка которой превысила 130 миллиардов долларов. Его уход с OpenSea до серьезного спада на рынке NFT рассматривался как знаковый сигнал. OpenRouter стала крупнейшим хабом в эпоху ИИ, подключившись к более чем 400 AI-моделям, имея около 10 миллионов пользователей и обрабатывая более 200 триллионов токенов в месяц. Однако, несмотря на быстрый рост, это бизнес с большими объемами, но ограниченной рентабельностью. Его основная бизнес-модель заключается в взимании комиссии за платформу (около 5-5,5%) при вызове разработчиками AI-моделей. Конкуренция на рынке агрегации AI-моделей также обостряется. Высокая оценка OpenRouter, возможно, больше отражает его будущий потенциал, чем текущую прибыльность. Для потенциальных покупателей наиболее ценным активом могут быть не текущие доходы, а накопленные реальные данные об использовании ИИ, которые трудно быстро воспроизвести. От NFT к ИИ Алекс Аталла дважды поймал волну технологического бума. Если продажа OpenRouter состоится с оценкой в 100 миллиардов долларов, это может означать либо переоценку стоимости инфраструктуры ИИ, либо сигнал о новом пике цикла. Ответ на этот вопрос даст только время.

链捕手5 ч. назад

От OpenSea до OpenRouter: Алекс Аталлах повторяет сценарий «ухода на пике»?

链捕手5 ч. назад

Приближается ли Биткойн к очередной зоне накопления? ЭТОТ сигнал говорит «да»

Аналитики отмечают, что Bitcoin (BTC) переживает один из самых длительных медвежьих периодов, охватывающий три квартала и два календарных года, при этом его динамика отклонилась от рынка акций. Однако сохраняется корреляция с акциями Apple (AAPL). График соотношения BTC/AAPL с 2017 года движется в восходящем канале, где его нижняя граница традиционно сигнализирует о зоне недооценки (накопления) для Bitcoin, а верхняя — о перекупленности. В настоящее время соотношение приближается к линии поддержки, что, по историческим данным, может предшествовать новой фазе роста BTC. При этом в 2025 году нарушилась многолетняя корреляция годовой доходности Bitcoin с индексами S&P 500 и Nasdaq 100, что объясняется его более резкой реакцией на макроэкономические потрясения. В качестве подтверждающего сигнала для разворота рассматриваются поступления стейблкоинов на криптобиржи, которые указывают на готовность капитала к реинвестированию. За последние семь дней чистый приток составил $1,42 млрд, что значительно меньше оттока в $10 млрд за предыдущие 30 дней и пока недостаточно для уверенного старта ралли. Таким образом, соотношение BTC/AAPL указывает на возможное приближение к зоне накопления, но для подтверждения тренда необходимы более значительные притоки стейблкоинов.

ambcrypto6 ч. назад

Приближается ли Биткойн к очередной зоне накопления? ЭТОТ сигнал говорит «да»

ambcrypto6 ч. назад

Торговля

Спот
活动图片