Срочно: Маск представляет самый мощный Grok 4.5, с ценой уровня Opus по огромной скидке

marsbitОпубликовано 2026-07-09Обновлено 2026-07-09

Введение

SpaceXAI представила флагманскую модель Grok 4.5, разработанную совместно с Cursor. Модель демонстрирует высокую производительность в тестах SWE Bench Pro (64,7%), Terminal Bench 2.1 (83,3%) и DeepSWE 1.0 (62,0%), сравнимую с такими моделями, как OpenAI GPT-5.5 и Opus 4.7/4.8. Её ключевыми преимуществами объявлены высокая скорость (80 TPS) и эффективность: при решении задач Grok 4.5 использует в 4,2 раза меньше токенов, чем Opus 4.8. Цена составляет $2 за 1 млн входных токенов и $6 за 1 млн выходных. Модель натренирована на огромном количестве высококачественных данных от Cursor, включающих реальные сценарии взаимодействия разработчиков. Маск пообещал, что следующая версия получит контекст до 1 млн токенов и выйдет уже в следующем месяце, ознаменовав новый качественный скачок.

Grok 4.5, наконец-то сдан!

Только что SpaceXAI Илона Маска шокирующе представила свой самый мощный флагманский модели Grok 4.5 в истории.

На этот раз SpaceXAI и Cursor объединили усилия.

На десятках тысяч гигантских систем GB300 они «выковали» этого производительного монстра, созданного специально для программирования и агентов.

Результаты впечатляют —

  • SWE Bench Pro: уверенно набирает 64.7%, напрямую противостоит и превосходит 64.3% у Opus 4.7;
  • Terminal Bench 2.1: мчится до 83.3%;
  • DeepSWE 1.0: стабильно стоит на 62.0%, решительно подавляя Opus 4.8.

Маск прямо заявил: «Grok 4.5 примерно соответствует Opus 4.7, но гораздо быстрее».

Совокупность возможностей, скорости и стоимости — вот в чем его конкурентоспособность. То есть, для работы он использует токены, которых у других лишь крохи.

Цена ввода для Grok 4.5 составляет $2/миллион токенов, вывода — $6/миллион токенов.

По сравнению с Opus 4.8, потребление токенов сократилось в 4.2 раза.

Десятки тысяч GB300 «выковали» модель уровня Opus

Grok 4.5 — это первый козырь SpaceXAI после выхода на биржу и первый результат их совместной работы с Cursor.

Итак, как же его тренировали?

Ответ: сверхмасштабное обучение на десятках тысяч графических процессоров Nvidia GB300. Но наращивание вычислительной мощности — это только пропуск на площадку.

Маск анонсирует: на следующей неделе контекст Grok 4.5 будет увеличен до 1 миллиона

Место, где SpaceXAI действительно упорно поработала, — это данные.

Они провели дьявольскую фильтрацию, удаление дубликатов и оценку качества огромного массива текстов, гарантируя, что каждая порция информации, подаваемая в модель, является профессиональным контентом с высокой информационной плотностью.

Затем они сосредоточили усилия по обучению с подкреплением на показателе, о котором редко говорят — «интеллект на токен» (per-token intelligence).

Присоединение Cursor стало ключевым элементом в этой системе.

Основой Grok 4.5 является V9 (1.5T). По официальной информации, при обучении в модель было загружено триллионы данных от Cursor.

Эти данные записывают, как реальные разработчики взаимодействуют с репозиториями кода, инструментами и агентами.

Это означает, что модель изучает не только «как выглядит код», но и «как люди и ИИ вместе пишут код».

А его тренировочный стек спроектирован для высокой асинхронности —

агенты могут работать непрерывно в течение нескольких часов, модель продолжает учиться, пока работает, а обучение на десятках тысяч GPU не прекращается ни на мгновение.

В результате модель не только решает задачи, но и способна справляться со сложными многошаговыми инженерными проектами в течение длительных, многочасовых заданий.

Достигает уровня GPT-5.5, приближается к Opus 4.8

Производительность Grok 4.5, полученная таким подходом к обучению, абсолютно выдерживает проверку.

Его результаты в ключевых инженерных бенчмарках можно охарактеризовать как «стабильные» — не самые сильные, но достаточно хорошие, чтобы войти в первую лигу.

На DeepSWE 1.0 он набрал 62.0%, обогнав Opus 4.8 (55.75%) и близко подобравшись к GPT-5.5 (64.31%);

На Terminal Bench 2.1 он взлетел до 83.3%, отстав от GPT-5.5 (83.4%) всего на 0.1!;

На более жестком SWE Bench Pro он с решением 64.7% обогнал GPT-5.5 (58.6%), приблизившись к Opus 4.8 (69.2%).

В официальном тесте AAAI Grok 4.5 занял четвертое место, уступив только Fable 5, GPT-5.5 и Opus 4.8.

В тесте Harvey на юридических агентах занял первое место.

Нельзя не сказать, что этот отчет о результатах очень сильный.

Но нужно признать, что на данный момент железный трон по-прежнему уверенно занимает Claude Fable.

В целом, Grok 4.5 и GPT-5.5 в основном находятся на одном уровне, близко к Opus 4.8, но до настоящего потолка еще есть расстояние.

Сам Маск говорит очень прагматично: «По нашей внутренней оценке, Grok 4.5 примерно соответствует Opus 4.7, но гораздо быстрее».

Настоящий козырь: быстрый и дешевый

Настоящий удар Grok 4.5 скрыт в трех словах: скорость, эффективность и цена.

Его скорость логического вывода достигает 80 TPS (токенов в секунду). Официальная формулировка: «быстрее, чем модели класса flash».

Всего одной фразой он написал симулятор 3D-солнечной системы на Three.js:

Поддержка ускорения времени, реалистичное орбитальное движение восьми планет, даже панель HUD сделана весьма искусно.

В плане эффективности, в задачах SWE Bench Pro, Grok 4.5 в среднем выдает всего 15 954 токена, чтобы решить проблему.

В то время как Opus 4.8 для той же работы в среднему должен выдать 67 020 токенов.

В 4.2 раза — Grok 4.5 использует менее четверти токенов соперника, чтобы выполнить ту же инженерную задачу.

В плане цены: ввод $2 за миллион токенов, вывод $6 за миллион токенов.

Кроме того, есть более быстрая расширенная версия с ценой ввода $4 / вывод $18.

По сравнению с множеством топовых моделей, которые стартуют от десятков долларов, эта цена практически доводит стоимость до минимума.

Совокупность этих трех цифр приводит к одному выводу:

В вопросе «сколько интеллекта можно купить за единицу времени и единицу стоимости» Grok 4.5 на данный момент является «королем соотношения цены и качества».

Тестирование в сети: реальные результаты Grok 4.5

Кроме того, из отзывов множества пользователей в сети можно увидеть проблеск реальных возможностей Grok 4.5.

Одной фразой — прямо генерирует «Майнкрафт».

В отдельном HTML-файле Grok 4.5 с легкостью справляется с созданием полноценной страницы для премиального SaaS-продукта.

Grok 4.5 проявляет себя во всей красе, завершая полный набор 2D+3D дизайнерских решений прямо в приложении менее чем за минуту.

Великий мастер игр на ИИ Danny Limanseta использовал Grok 4.5 для создания игры с полным набором функций.

Однако некоторые разработчики отмечают, что Grok 4.5 совершенно не находится на одном уровне с Opus 4.7, и тестовая генерация лавовой лампы получилась плохой.

Не самый сильный, но готовится перевернуть стол в следующем месяце

Сегодня Маск снова заложил мину:

Grok глубоко понимает инженерное дело.

Версия следующего месяца станет очередным скачком, потому что мы замыкаем петлю по решению реальных инженерных проблем в Tesla, SpaceX, Neuralink и Boring Company.

В следующем месяце — еще один скачок. И, по слухам, в разработке уже находится более крупная версия с 2 триллионами параметров.

Бенчмарки — это фейерверк для посторонних; эффективность и стоимость — вот реальное оружие для затяжной войны с противником.

Когда интеллект модели начинает измеряться, как электричество, победителем становится тот, кто может сделать интеллект быстрым, дешевым и повсеместным.

На этот раз Маск не разыграл самую сильную карту, но перевернул игровой стол.

Ссылки:

https://x.ai/news/grok-4-5

https://cursor.com/blog/grok-4-5

Эта статья из официального аккаунта WeChat «New Zhiyuan», автор: ASI启示录, редактор: Персик.

Связанные с этим вопросы

QКакие основные достижения демонстрирует модель Grok 4.5 в тестах на производительность, согласно статье?

AМодель Grok 4.5 показывает выдающиеся результаты в ключевых инженерных тестах: SWE Bench Pro — 64.7%, что превосходит GPT-5.5 (58.6%) и приближается к Opus 4.8 (69.2%); Terminal Bench 2.1 — 83.3% (почти на уровне GPT-5.5); DeepSWE 1.0 — 62.0%, что превосходит Opus 4.8 (55.75%). Кроме того, в официальном тесте AAAI она заняла четвёртое место, а в тесте Harvey для юридических агентов — первое.

QВ чём заключаются главные конкурентные преимущества Grok 4.5 по сравнению с моделями вроде Opus?

AГлавными преимуществами Grok 4.5 являются эффективность, скорость и цена. Модель потребляет значительно меньше токенов для решения задач (например, в 4.2 раза меньше, чем Opus 4.8 на SWE Bench Pro), обладает высокой скоростью вывода — 80 токенов в секунду, и предлагает низкую стоимость: 2 доллара за 1 млн входных токенов и 6 долларов за 1 млн выходных. Это делает её лидером по соотношению «интеллект за единицу времени и стоимости».

QКак происходило обучение модели Grok 4.5 и какая роль в этом была у Cursor?

AОбучение Grok 4.5 проводилось на тысячах графических процессоров Nvidia GB300 в рамках масштабного сотрудничества между SpaceXAI и Cursor. Ключевую роль сыграли уникальные данные от Cursor — триллионы записей о том, как реальные разработчики взаимодействуют с кодом и инструментами. Это позволило модели изучить не только синтаксис кода, но и рабочие процессы. Также был сделан акцент на обучении с подкреплением, чтобы повысить «интеллект на один токен» (per-token intelligence), а асинхронный тренировочный стек позволил модели обучаться во время выполнения длительных задач.

QЧто Илон Маск и SpaceXAI обещают в отношении будущих версий Grok?

AИлон Маск заявил, что уже в следующем месяце ожидается новая версия с «скачкообразным улучшением». Это произойдёт благодаря интеграции опыта решения реальных инженерных задач в таких компаниях, как Tesla, SpaceX, Neuralink и The Boring Company. Также в статье упоминается, что в разработке находится более крупная версия модели с 2 триллионами параметров.

QКакие примеры практического применения Grok 4.5 приводят пользователи в статье?

AВ статье приводятся примеры применения Grok 4.5 пользователями: создание 3D-симулятора Солнечной системы на Three.js по одному запросу, генерация полноценной страницы для SaaS-продукта в одном HTML-файле, создание игрового мира, похожего на «Minecraft», а также быстрое проектирование 2D+3D дизайна в приложении. Однако есть и критические отзывы, например, о неудовлетворительной генерации «лавовой лампы», где модель показала результат хуже, чем у конкурентов.

Похожее

Паркер Льюис ответил, почему биткоин остаётся лучшими деньгами

Известный биткоин-аналитик Паркер Льюис раскритиковал стратегии публичных компаний, позиционирующих себя как криптовалютные казначейства. Он заявил, что продажа ими «цифрового кредита» в виде бессрочных привилегированных акций искажает суть биткоина, который не генерирует фиатный доход на алгоритмическом уровне. Льюис подчеркнул, что выплата дивидендов в этой модели часто зависит от притока новых инвесторов, что несёт высокие риски, наглядно демонстрируемые скромным размером рынка таких акций ($1 трлн) на фоне глобального кредитного рынка ($300 трлн). Эксперт также опроверг тезис о чрезмерной волатильности биткоина, объяснив её как естественное следствие массового принятия актива с жёстко ограниченным предложением. Он призвал инвесторов покупать биткоины напрямую, а не акции компаний вроде MicroStrategy, что математически безопаснее. Льюис указал на главную угрозу — инфляцию фиатных денег, проиллюстрировав её личным «Индексом рибая», показывающим рост цен на 12–13% годовых. В итоге, наиболее надёжной стратегией защиты сбережений он назвал прямое владение биткоином и контроль над приватными ключами, предостерегая от скрытых рисков погони за корпоративной доходностью через деривативы.

cryptonews.ru1 ч. назад

Паркер Льюис ответил, почему биткоин остаётся лучшими деньгами

cryptonews.ru1 ч. назад

Почему биткоин удерживает $64 000 после жесткой паузы ФРС

Федеральная резервная система США оставила ключевую ставку без изменений, но жесткая риторика и голосование (9 против 3) показали готовность к дальнейшему ужесточению, что ограничивает аппетит к рисковым активам. Несмотря на это, биткоин демонстрирует устойчивость, удерживаясь около уровня $64 000 после волатильной реакции на заявление ФРС. Ключевая поддержка находится в зоне $63 000–63 500, сопротивление — около $66 000. На рынке наблюдается ротация капитала: спотовые Bitcoin-ETF после серии оттоков показали чистый приток в $32,1 млн, тогда как фонды на Ethereum продолжили терять средства. Интерес институциональных инвесторов сместился в сторону биткоина как основного актива, хотя отдельные альткоины, такие как Solana, также привлекают капитал. Рыночная доля Ethereum снижается, несмотря на сильные фундаментальные показатели сети, включая растущую очередь на стейкинг. Законодательная инициатива CLARITY Act была отложена Сенатом США до осени, что снизило рыночные ожидания относительно её принятия в 2026 году. В последний день июля внимание инвесторов будет приковано к макроэкономической статистике из США. Устойчивость биткоина выше $63 000, закрепление Ethereum над $1 860 и продолжение притоков в ETF могут стать сигналами для формирования базы восстановления во второй половине года.

cryptonews.ru1 ч. назад

Почему биткоин удерживает $64 000 после жесткой паузы ФРС

cryptonews.ru1 ч. назад

Компания ARK Invest Кэти Вуд купила 109,129 акций Circle на $6,83 млн

Компания ARK Invest Кэти Вуд приобрела 109 129 акций компании Circle на сумму около 6,83 млн долларов США. Покупка была осуществлена через три ее биржевых фонда: ARK Innovation, ARK Next Generation Internet и ARK Fintech Innovation. Эта сделка произошла вскоре после того, как Circle получила лицензию на доверительное управление от Департамента финансовых услуг штата Нью-Йорк для своей дочерней компании Circle New York Trust. Генеральный директор Circle Джереми Аллер назвал получение лицензии долгосрочной целью компании. Однако, несмотря на это регулирующее одобрение, акции Circle (CRCL) 31 июля снизились на 2,54%, что, вероятно, указывает на сдержанную реакцию инвесторов на данную новость. Параллельно ARK Invest также совершила крупные покупки акций Tesla, SpaceX и Nvidia на общую сумму около 40,2 млн долларов, одновременно сократив свои доли в таких компаниях, как Shopify, Cloudflare и CrowdStrike.

cryptonews.ru1 ч. назад

Компания ARK Invest Кэти Вуд купила 109,129 акций Circle на $6,83 млн

cryptonews.ru1 ч. назад

Арестованы участники мошеннической схемы с XRP, похитившие 9 млн долларов у 71 инвестора

Полиция Сеула арестовала трех участников мошеннической инвестиционной платформы, похитивших примерно 3,4 млн XRP (около 9 млн долларов) у 71 инвестора. Группа продвигала сайт Fxrpntwork.com через блоги и YouTube, обещая гарантированную сохранность вкладов и ежемесячный доход до 1,8%, после чего исчезла с деньгами. Мошенники использовали названия и брендинг легитимных проектов Flare Network и FXRP для создания видимости надежности. Полиция предупреждает инвесторов о необходимости проверять официальные источники и не доверять непроверенной информации в интернете. Дело передано прокуратуре, ведется розыск еще одного подозреваемого за рубежом с помощью Интерпола. В ходе расследования были заморожены активы на крупную сумму и выявлены дополнительные транзакции, что указывает на возможных новых потерпевших и соучастников. Этот случай иллюстрирует распространенность мошеннических схем с гарантированной доходностью в криптосфере.

cryptonews.ru1 ч. назад

Арестованы участники мошеннической схемы с XRP, похитившие 9 млн долларов у 71 инвестора

cryptonews.ru1 ч. назад

Торговля

Спот
活动图片