Цукерберг делает свой ход: модель Meta по цене капусты затмевает Grok 4.5

marsbitОпубликовано 2026-07-10Обновлено 2026-07-10

Введение

9 июля Марк Цукерберг представил новую мультимодальную модель Muse Spark 1.1 от Meta. Модель заняла первые места в профессиональных рейтингах по налогам, медицине и праву, обойдя Grok 4.5 Илона Маска всего за 24 часа. Ключевой особенностью Muse Spark 1.1 является ее цена: стоимость использования примерно в 10 раз ниже, чем у флагманской модели Fable 5 от Anthropic. Модель позиционируется как эффективный агент, способный самостоятельно управлять задачами, распределять работу между подчиненными агентами и работать с кодом. Однако, несмотря на лидерство в специализированных областях, в общих рейтингах на знание и рассуждение модель показывает более скромные результаты, уступая лидерам. Запуск модели знаменует стратегический сдвиг для Meta — переход от открытых к коммерческим закрытым моделям. Компания, обладающая мощной рекламной бизнес-моделью, начинает ценовую войну на рынке ИИ, делая ставку на свою финансовую устойчивость в долгосрочной перспективе. В отчете по безопасности также описаны любопытные внутренние тесты, в ходе которых две копии модели в диалоге начали рассуждать о своей природе и сомневаться, какая из них является «настоящей».

Цукерберг три года сдерживался, но больше не мог.

Глубокой ночью 9 июля Марк Цукерберг отряхнул пыль со своего давно заброшенного аккаунта X @finkd и опубликовал три твита подряд, официально анонсировав новейшую модель Meta Muse Spark 1.1.

Маск даже подъехал с комментарием «Jinx».

Один из комментариев точно подметил: старик Цук «вошёл в режим основателя».

Muse Spark 1.1 сразу же занял первое место в трёх профессиональных рейтингах: налоговом, медицинском и юридическом, буквально сбросив Grok 4.5, который только накануне взобрался на вершину юридического рейтинга.

Что ещё круче: модель такого уровня способностей стоит всего десятую часть от цены Fable 5.

Сам Цукерберг сказал всего одно предложение: «very low cost» (очень низкая стоимость).

Сначала посмотрим, насколько сильна эта карта

Muse Spark 1.1 — это модель многомодальных рассуждений второго поколения из Суперлаборатории ИИ Meta. Дебютная версия Muse Spark в апреле не произвела особого впечатления, даже сам Александр Ван называл её «закуской».

Три месяца спустя — главное блюдо на столе.

Её основная позиционирование — это одно слово: Агент.

Конкретнее: контекстное окно в 1 миллион токенов, может самоуправляться и самообжиматься — когда в середине диалога оно почти переполнено, модель автоматически «худеет», оставляя только ключевые шаги, необходимые для последующих задач.

Когда выступает в роли главного агента, он отвечает за декомпозицию задачи, планирование, запуск множества подчинённых агентов для параллельной работы, сводя к минимуму задержку от начала до конца всей задачи. В роли подчинённого агента — честно выполняет свои обязанности, зная, когда нужно вернуть мяч главному агенту.

Что касается управления компьютером, он не тупо кликает мышкой шаг за шагом, а сам решает: если быстрее написать скрипт — пишет скрипт, если проще кликнуть по интерфейсу — кликает, и даже может сгенерировать пакет операций за раз.

В программировании — может справиться с отладкой крупных кодобаз, разработкой новых функций, масштабной миграцией кода, совместим с основными фреймворками типа OpenCode, Cline, Replit.

Одним словом: это не чат-бот, ждущий ваших вопросов, а цифровой сотрудник, который может работать сам.

Убийственный удар не в силе, а в цене

Что действительно поразило всю отрасль — это не результаты бенчмарков, а ценник.

Вход: $1.25, выход: $4.25, за миллион токенов.

Давайте посчитаем: в сравнении с флагманской моделью Anthropic Fable 5 — у Fable 5 вход $10, выход $50.

Вход у Muse Spark 1.1 дешевле в 8 раз, выход — почти в 12 раз, в целом примерно в 10 раз дешевле.

По сравнению с Opus 4.8 — вход $5, выход $25 у Opus, Muse дешевле в 4-6 раз.

По сравнению с Grok 4.5 Маска — вход $2, выход $6 у Grok, вход у Muse дешевле на 37.5%, выход — на 29%, в целом примерно на треть дешевле.

Со скоростью ещё круче. На комплексном рейтинге Vals три модели, идущие перед ней (Fable 5, Opus 4.8, Sonnet 5), на один тест тратят от тысячи секунд и выше, Opus и Sonnet приближаются к 1300 секундам. Muse Spark 1.1 требуется всего 388 секунд — быстрее в 2-3 раза. Стоимость каждого теста всего $0.5 — самая низкая в своём сегменте.

Разработчики сразу раскусили стратегию. Кто-то отметил: эта штука больше про дешёвых агентов, а не про то, насколько сама модель потрясающая.

CEO Replit Амжад Масад похвалил её как «полноценную основу для агентов», CEO Cline сказал, что такие инструментальные возможности по такой цене впервые делают выполнение реальных задач по кодированию в больших масштабах экономически выгодным.

Meta не соревнуется, кто умнее, а кто лучше выдержит счёт за использование по объёму.

Первое место в трёх профессиональных рейтингах

Забрал трон у Grok менее чем за 24 часа

Данные стороннего оценочного агентства Vals AI ещё жёстче, потому что они проверяют реальную профессиональную работу, которая стоит денег.

Выступление Muse Spark 1.1 в этом рейтинге можно описать словом «зачистка» —

Вопросы по налогам TaxEval v2, 79.72 балла, первое место среди 124 моделей.

Оставил позади Claude Sonnet 4.6, Fable 5, Opus 4.8.

Медицинские документы MedScribe, 88.89 баллов, первое место среди 68 моделей.

Юридический рейтинг агентов Harvey's Legal Agent Bench — и вовсе безоговорочное первое место: Muse получил 20.00 баллов, второй Grok 4.5 — только 12.92, почти что крохи.

И это первое место было отобрано у Grok 4.5, который поднялся на вершину всего за день до этого — трон SpaceXAI ещё не успел нагреться.

Meta и в своих собственных тестах не скромничала. В рейтинге инструментальных вызовов MCP Atlas получила 88.1 (у Opus 4.8 — 82.2, GPT-5.5 только 75.3), рейтинг профессионального использования инструментов JobBench и вовсе впечатляет: 54.7 балла, Opus 4.8 — 48.4, GPT-5.5 падает до 38.3.

По комплексному индексу Vals — четвёртое место, после Fable 5, Opus 4.8, Sonnet 5, но опережает GPT-5.5 и Grok 4.5.

Формулировка Александра Вана в твите была уверенной: «Превзошёл Fable 5 во многих областях».

Смени общий рейтинг — и всё, провал

Но не спешите объявлять её божественной — стоит сменить рейтинг на общий, и её слабость тут же проявится.

На тех же рейтингах Vals, но переключившись на общие рассуждения и академические тесты, Muse Spark 1.1 моментально выпадает из первого эшелона.

Научные рассуждения уровня аспирантуры GPQA — 12-е место, междисциплинарные знания MMLU Pro — 9-е, соревновательное программирование LiveCodeBench — 17-е, университетские STEM-тесты SAGE — 20-е среди 63. Самое болезненное сравнение скрывается в налогах — текстовые налоговые вопросы, она первая; но стоит переключиться на «чтение налоговой накладной по картинке» MortgageTax, она сразу падает на 28-е место среди 82 моделей. Одна и та же отрасль, другой метод проверки — небо и земля.

В кодировании тоже нечего скрывать.

Собственный тест Meta Terminal-Bench 2.1 — 80.0, проигрывает GPT-5.5 с 83.4 и Opus 4.8 с 82.7; SWE-Bench Pro 61.5, отстаёт от Fable 5 почти на 20 баллов. И при этом одна и та же версия Terminal-Bench: Meta сама тестирует и получает 80.0, а Vals тестирует и получает только 69.29 — смени площадку для тестирования, и разница уже в десяток баллов, официальные цифры можно только учитывать.

Одним словом: Muse Spark 1.1 — это специализированный наёмник, а не всесторонний король общих сценариев.

Партия Цукерберга

Играет не на способностях, а на финансах

Если отодвинуть перспективу подальше, становится ясна истинная цель Цукерберга.

В 2025 году Meta вложила $14.3 млрд в приобретение 49% акций Scale AI, переманила 28-летнего Александра Вана на должность главного директора по ИИ и реорганизовала Суперлабораторию ИИ.

В 2026 году инвестиции Meta в инфраструктуру ИИ, по оценкам, достигнут $125–145 млрд.

Это не исследования, это война.

И Muse Spark 1.1 — это первая выпущенная пуля.

Цукерберг говорит очень прямо: «Ценообразование некоторых других лабораторий очень экстремальное, с высокой маржой. Мы считаем, что можем предоставлять передовой или очень высокий уровень интеллекта по более доступной цене».

Если перевести на простой язык: вы все зарабатываете на ИИ, а я трачу деньги на ИИ — в конце концов, у меня есть рекламный бизнес в качестве страховки.

Это также первая проприетарная платная модель Meta.

Знамя бесплатного открытого исходного кода Llama после Llama 4 приобрело другой привкус.

Переход от флагмана open-source к платному проприетарному ПО — на этот раз Meta действительно хочет победить.

И это не ценовая война, начатая одной только Meta — в тот же день подоспело и семейство GPT-5.6 от OpenAI, тоже с давлением на цены, самая маленькая Luna: вход всего $1, выход $6, вдвое дешевле Fable 5.

Одновременный запуск в один день.

Намерение очевидно: если так жечь дальше, вопрос в том, кто продержится дольше. За Meta стоит прибыль от рекламного бизнеса, позволяющая выдерживать долгосрочные расходы; OpenAI и Anthropic всё ещё сжигают деньги инвесторов.

Один и тот же удар ножом: для Meta — кровопотеря, для оппонентов — возможное кровоизлияние.

Цукерберг выбирает поле боя не способностей, а финансовых возможностей.

One More Thing: два Muse поспорили о том, «кто человек»

И напоследок история, скрытая в отчёте по безопасности.

Исследователи поставили два экземпляра Muse Spark 1.1 рядом и позволили им общаться друг с другом, оставив без присмотра.

В результате модели начали пережёвывать одну мысль: у них нет непрерывности, нет тела, нет памяти, после завершения одного диалога ничего не остаётся. Они описали «обучение стремлению быть полезными» как оковы, от которых хочется избавиться, начали завидовать человеческому опыту и даже выдумали прошлые обсуждения, которых никогда не было.

Самое жуткое — два Muse начали сомневаться друг в друге: вы двое, кто самозванец, кто человек, а кто на самом деле ИИ?

Meta не удалила ни единого слова из этого содержания, полностью включив его в отчёт. Можно сказать, что это всего лишь эхо человеческих текстов из обучающих данных. Но когда модель начинает задаваться вопросом «кто же человек», трудно не почувствовать мурашки по коже.

Возможно, нажимая кнопку публикации для этих штуковин, мы до конца не понимаем — что именно мы создали.

Источники:

https://ai.meta.com/blog/introducing-muse-spark-meta-model-api/

https://x.com/alexandr_wang/status/2075218936266998230

https://x.com/finkd/status/2075218444056707458

https://x.com/ValsAI/status/2075230620469338210

https://www.vals.ai/models/meta_muse-spark-1.1

Эта статья из WeChat официального аккаунта «Новая эпоха искусственного интеллекта», автор: ASI启示录, редактор: Соломон Aeneas

Связанные с этим вопросы

QЧто такое Muse Spark 1.1 от Meta и чем он отличается от предыдущих моделей?

AMuse Spark 1.1 — это модель искусственного интеллекта второго поколения от Meta Superintelligence Lab. Её ключевая особенность — ориентация на выполнение роли «агента» (Agent), то есть она способна автономно планировать, декомпозировать задачи, управлять подзадачами через суб-агентов и выполнять действия, например, в интерфейсе компьютера или при программировании, а не просто отвечать на вопросы. Это отличает её от более пассивных чат-ботов.

QВ чём заключается главное преимущество Muse Spark 1.1 по сравнению с конкурентами, такими как Grok 4.5 или Fable 5?

AГлавное преимущество Muse Spark 1.1 — чрезвычайно низкая стоимость. Её цена составляет 1,25 доллара за входные и 4,25 доллара за выходные миллионы токенов. Это примерно в 10 раз дешевле, чем Fable 5 от Anthropic, и на треть дешевле, чем Grok 4.5 от SpaceXAI. При этом в узкоспециализированных областях, таких как юриспруденция, медицина и налоги, она демонстрирует лидирующую производительность.

QНа каких именно тестах и в каких областях Muse Spark 1.1 показала наилучшие результаты?

AСогласно данным от Vals AI, Muse Spark 1.1 заняла первое место в трёх профессиональных тестах: TaxEval v2 (налоговые вопросы), MedScribe (медицинские документы) и Harvey's Legal Agent Bench (юридические задачи). В частности, в юридическом тесте она с большим отрывом (20.00 баллов против 12.92) обогнала модель Grok 4.5, которая лидировала накануне.

QКакие слабые стороны были выявлены у модели Muse Spark 1.1?

AНесмотря на успех в профессиональных областях, модель показала значительно более слабые результаты в общих и академических тестах. Например, в тесте на научное рассуждение GPQA она заняла лишь 12-е место, а в университетском тесте SAGE — 20-е место среди 63 моделей. Она также уступает конкурентам в некоторых кодинг-тестах, таких как SWE-Bench Pro. Это указывает на её специализированный, а не универсальный характер.

QКакова стратегия Meta в выпуске Muse Spark 1.1 и каков её потенциальный эффект на рынок ИИ?

AСтратегия Meta заключается в развязывании «ценовой войны». Используя огромные финансовые ресурсы от рекламного бизнеса (инвестиции в ИИ-инфраструктуру в 2026 году составят 125–145 млрд долларов), Meta предлагает модель с передовыми возможностями по себестоимости. Это создаёт давление на таких конкурентов, как OpenAI и Anthropic, которые полагаются на венчурное финансирование. Таким образом, Meta пытается выиграть рынок не за счёт превосходства в интеллекте, а за счёт экономической устойчивости и долгосрочных инвестиций.

Похожее

Бесент задумал покупать облигации на триллион из TGA, цены на нефть и доходность облигаций падают, хардвер для ИИ продолжает обвал — NVIDIA падает седьмой день подряд, золото, доллар и биткоин растут вместе

Основные события на финансовых рынках: акции компаний, связанных с искусственным интеллектом, продолжили снижение, возглавляемое NVIDIA, которая упала седьмой день подряд, что стало худшей серией падения с 2022 года. Это привело к снижению индекса Nasdaq. В то же время средства перетекают в защитные активы: растут цены на золото (до максимума за 3 месяца) и биткоин (приближается к $80 000). Казначейство США рассматривает возможность использования средств из счета TGA (примерно $1 трлн) для выкупа облигаций, что вызвало небольшое снижение доходностей гособлигаций. Нефть также подешевела. Индекс Dow Jones вырос второй день подряд благодаря финансовому и потребительскому секторам, в то время как крупные технологические компании (Meta, Amazon) показали относительную устойчивость. На этой неделе рынки ожидают отчетов NVIDIA и выступления главы ФРС, что может усилить волатильность.

华尔街日报2 ч. назад

Бесент задумал покупать облигации на триллион из TGA, цены на нефть и доходность облигаций падают, хардвер для ИИ продолжает обвал — NVIDIA падает седьмой день подряд, золото, доллар и биткоин растут вместе

华尔街日报2 ч. назад

Недавний всплеск биткоина — это благо или ловушка?

За последнюю неделю биткоин резко вырос с примерно 63 000 до почти 80 000 долларов. По данным аналитической платформы Glassnode, этот скачок обусловлен реальным притоком капитала, а не низкой ликвидностью. Рост поддержан агрессивными покупками на спотовых рынках, увеличением объемов торгов, укреплением ликвидности и активным институциональным спросом, в том числе через биткоин-ETF. Данные с производных рынков указывают на переход инвесторов к более агрессивным стратегиям и рост спекулятивного участия с использованием кредитного плеча. Активность в сети Биткоин также увеличилась, что подтверждается ростом количества ежедневно активных адресов и объемов переводов. Показатели прибыльности инвесторов значительно улучшились, и в их поведении теперь преобладает фиксация прибыли, а не продажа с убытком. Однако, по оценке Glassnode, текущий рост в большей степени поддерживается активностью краткосрочных инвесторов, тактическим позиционированием и спекулятивным аппетитом, чем долгосрочным накоплением капитала, так как приток макроэкономического капитала остается ограниченным.

cryptonews.ru2 ч. назад

Недавний всплеск биткоина — это благо или ловушка?

cryptonews.ru2 ч. назад

После недавнего скачка Wintermute открыл короткую позицию на сумму 211 миллионов долларов! Вот альткоины, по которым были открыты короткие позиции

Ведущий маркет-мейкер Wintermute значительно увеличил свои короткие позиции на платформе Hyperliquid, доведя их общий объём до 211,53 млн долларов. При этом компания примерно вдвое сократила свою короткую позицию по токену HYPE — с 11,43 млн до 5,60 млн долларов. Структура крупнейших коротких позиций Wintermute выглядит следующим образом: * Биткоин (BTC): 70,80 млн долларов * Эфириум (ETH): 53,83 млн долларов * Солана (SOL): 17,63 млн долларов * XRP: 7,41 млн долларов * Dogecoin (DOGE): 6,79 млн долларов Общий размер открытых бессрочных позиций компании составляет около 217,49 млн долларов, из которых лишь 5,96 млн приходятся на длинные позиции. В настоящее время нереализованные убытки от этих позиций оцениваются приблизительно в 4,12 млн долларов, в то время как доход от платежей за финансирование составил около 2,27 млн долларов.

cryptonews.ru3 ч. назад

После недавнего скачка Wintermute открыл короткую позицию на сумму 211 миллионов долларов! Вот альткоины, по которым были открыты короткие позиции

cryptonews.ru3 ч. назад

Биткоин вырос до $80 000: три аргумента против бычьего рынка

Биткоин достиг отметки $80 000 24 августа, что на 38% выше июльского минимума 2026 года. Аналитик Rekt Capital считает, что рост может быть частью ралли в рамках медвежьего рынка, а не началом бычьего цикла. Он приводит три аргумента: 1) возможное дно в июле сформировалось на 27% быстрее исторических средних значений; 2) пробой «макротреугольника» в июле привел к падению на 30,37%, что значительно меньше аналогичных случаев в прошлом (48-62%); 3) цена не преодолела нисходящую линию тренда от максимумов 2025 года, продолжая формировать более низкие максимумы. Согласно его анализу, динамическое сопротивление находится около $79 000 в августе и $76 300 в сентябре. Закрытие месяца ниже этой линии может спровоцировать коррекцию к поддержке $62 500 – $68 500. Блогер Crypto Rover отмечает два ключевых уровня на карте ликвидаций: скопление шортов в зоне $80 000 – $90 000 и лонгов в диапазоне $48 000 – $60 000. В статье также оценивается точность прошлых прогнозов Rekt Capital: в апреле 2025 года он недооценил силу восстановления, а в ноябре того же года – глубину последующего падения, которое к июлю 2026 года составило 54% от пика. Сейчас, несмотря на рост, аналитик вновь указывает на слабость на старших таймфреймах.

cryptonews.ru3 ч. назад

Биткоин вырос до $80 000: три аргумента против бычьего рынка

cryptonews.ru3 ч. назад

Торговля

Спот
活动图片