Результаты первых внутренних тестов GPT-5.6 Sol: стоимость аналогичной задачи в два раза ниже, чем у Fable 5

marsbitОпубликовано 2026-07-06Обновлено 2026-07-06

Введение

Представлены первые результаты закрытого тестирования GPT-5.6 Sol. Модель демонстрирует высокую эффективность: по данным инженера Nvidia, она достигла эффекта ускорения CUDA за 30 часов, в то время как Opus потребовалось 64 часа. В задачах кодирования Sol генерирует более лаконичный код — примерно в 5 раз меньше строк, чем у Opus, что упрощает долгосрочную поддержку проектов. Хотя в некоторых тестах, особенно в создании сложного контента (например, 3D-игр), Sol пока немного уступает Fable 5, его ключевым преимуществом является стоимость: цена Sol примерно в два раза ниже (5$ за млн входных и 30$ за млн выходных токенов против 10$ и 50$ у Fable 5). Кроме того, пользователи отмечают, что ограничения безопасности в Sol менее строгие, чем в Fable 5. Модель оптимизирована для сложных, многоэтапных задач, требующих планирования и глубоких рассуждений. Ожидается, что GPT-5.6 Sol скоро станет доступен для всех пользователей, а не только для избранных партнеров.

GPT-5.6 Sol в предпросмотре выпущена уже почти полмесяца, и вот свежие результаты первых внутренних тестов пользователей!

Главный инженер NVIDIA говорит вам прямо, без всяких заумностей:

Sol — это мощь! За 30 часов она достигла эффекта ускорения CUDA, на который Opus потратил 64 часа.

После дальнейшей оптимизации версий, она, возможно, окончательно раздавит Opus......

Сетевые пользователи тоже не бездельничали, сразу начали развлекаться, всевозможные сравнения (и даже троллинг) множатся:

Возьмём, например, построение космического корабля. Посмотрите на коридор внутри кабины от GPT-5.6: сочетание цветов и выбор освещения очень технологичны, светотеневые переходы чёткие. А вот у версии 5.5 оттенки более тёплые и сероватые, изображение в целом выглядит плоским, больше напоминает раздевалку в компании.

Не говоря уже о космических сценах за пределами корабля: GPT-5.5 похожа на сборище пикселей. (doge)

В этом раунде GPT-5.6 одержала полную победу!

Почему же GPT-5.6 снова набирает такую популярность? Во-первых, старый конкурент Fable 5 вернулся, а во-вторых, модель наконец-то! начала! двигаться!

После стольких дней ожидания, наконец, появились слухи, что модель будет официально запущена в ближайшие два дня.

На этот раз она будет доступна не только нескольким «партнёрам» — теперь для всех!

(Те, кто ждал, выиграли~)

Сэм Альтман лично вышел на сцену, чтобы похвастаться, подняв настроение на самый высокий уровень:

Первый раз, когда мой ребёнок произнёс слово из двух слогов — это чувство потрясения точно такое же, как когда GPT-5.6 открыла новую математическую теорию.

Верно! Все родные (doge)

Опубликованы результаты первых внутренних тестов

Пролистав посты пользователей, участвовавших в тестировании, можно выделить несколько общих моментов.

Первый, уже упомянутый инженером NVIDIA: код становится лаконичнее, общий объём кода меньше.

Для одной и той же задачи другие модели могут написать кучу кода, а Sol явно более сдержанна: если можно решить в три строки, она не напишет пять. Количество строк кода составляет всего 1/5 от Opus. Особенно это касается C++: стиль написания очень похож на ручной, комментариев тоже меньше.

Для проектов, требующих долгосрочной поддержки, преимущество у Sol.

Конечно, в программировании есть и недостатки: например, скорость итеративного продвижения относительно медленная, количество неудач тоже больше, потому что Sol всегда пытается взяться за более сложные задачи.

По сравнению с Opus, у неё меньше подходов к пробным поискам и ошибкам: как только она определяет направление, то упорно его придерживается.

Проще говоря, модель отказалась от большого количества бездумных проб и ошибок, перейдя к долгосрочному углублённому изучению. Она не стремится к красивому внешнему виду результатов, а сосредоточена на оптимизации базовой производительности.

Это также хорошо соответствует позиционированию Sol от OpenAI —

Ориентация на длинные цепочки задач высокой сложности в рассуждениях, сложном коде и т.д., особенно подходит для сложных рабочих процессов, требующих планирования, итераций, вызова инструментов, координации шагов.

Тот же самый промпт, отправленный Sol и GPT-5.5 Pro, даёт очень наглядный контраст:

Будь то интерактивный SVG, 3D-модель или создание игры, способность Sol следовать инструкциям и пространственные рассуждения лучше, а согласованность также выше.

В области фронтенд-дизайна Sol также представила более чистый и аккуратный результат.

По сравнению с GPT-5.5, Sol лучше справляется с компоновкой страниц, иерархией и свободным пространством, изображение также более изысканное. В плане визуала Sol уверенно получает высокий балл.

Удачный выстрел по Fable 5?

Но если говорить о вопросе, который больше всего волнует пользователей — как она выглядит по сравнению с Fable 5?

Результаты, возможно, всё ещё немного хуже.

По некоторым бенчмаркам Sol и Fable 5 показывают одинаковые результаты или даже обгоняют, но в общем впечатлении от модели и качестве кода между Sol и Fable 5 всё ещё существует определённый разрыв.

Например, пользователь Gipp провёл сравнение 3D FPS игр.

Пока GPT 5.6 всё ещё пытается адаптироваться к игровому миру, освещению и геймплею, Fable 5 уже может превратить один промпт в готовую игру.

Однако стоимость Fable 5 гораздо выше: 10 долларов за миллион входных токенов и 50 долларов за выходные токены, в то время как затраты на Sol составляют всего 5 долларов за миллион токенов на входе и 30 долларов на выходе.

Sol почти в два раза дешевле!

Поэтому при схожих возможностях моделей, действительно трудно сказать, кто одержит победу в противостоянии Sol и Fable 5.

Что ещё хуже — это ограничения безопасности. После того как Fable 5 подверглась санкциям, в этот раз, вернувшись, пользователи явно почувствовали, что Fable 5 вообще не работает.

Обычное написание кода, отладка — стоит немного отвлечься, и система посчитает это высокорисковым, задача напрямую понижается до обработки Opus 4.8. Даже такой вопрос, как «сколько букв 'r' в слове 'raspberry'», был заблокирован.

Пользователи в ответ ставят Fable 5 плохие оценки......

У GPT-5.6 ситуация немного лучше. Официальные лица уже чётко заявили, что добавлена более мощная система безопасности, также будут настраиваться различные стратегии защиты в зависимости от возможностей модели, ограничения будут меньше, чем у Fable 5.

В общем, ждём полного запуска GPT-5.6, тогда мы и проверим на практике~

Ссылки:

[1]https://x.com/mark_k/status/2073467892889272609?s=20

[2]https://x.com/kimmonismus/status/2073799386535006210

[3]https://x.com/gippp69/status/2073697790723596469

Эта статья из официального аккаунта WeChat «Квантовый бит», автор: Лу Юй

Трендовые криптовалюты

Связанные с этим вопросы

QКаковы основные выводы из первых результатов внутреннего тестирования GPT-5.6 Sol?

AОсновные выводы: GPT-5.6 Sol демонстрирует более чистый и лаконичный код (примерно в 5 раз меньше строк, чем у Opus), лучшее визуальное восприятие и пространственное мышление. Он оптимизирован для сложных, многоэтапных задач, требующих планирования. Хотя в некоторых областях он может немного уступать Fable 5, его стоимость примерно в два раза ниже.

QКак GPT-5.6 Sol сравнивается с Fable 5 по стоимости и эффективности?

AПо эффективности GPT-5.6 Sol в некоторых тестах показывает результаты, сопоставимые с Fable 5 или даже превосходящие их, но в общем качестве кода и опыте использования может немного уступать. Однако ключевое преимущество Sol — стоимость: 5 долларов за миллион входных токенов и 30 долларов за миллион выходных против 10 и 50 долларов у Fable 5, что делает его почти в два раза дешевле для аналогичных задач.

QКакие ключевые улучшения в кодинге отмечают у GPT-5.6 Sol?

AТестировщики отмечают, что код от GPT-5.6 Sol более лаконичный и чистый, с меньшим количеством строк и комментариев, напоминая рукописный код опытного разработчика, особенно на C++. Модель фокусируется на глубинной оптимизации производительности, а не на поверхностных результатах, что делает код более удобным для долгосрочной поддержки проектов.

QКакие существуют недостатки или ограничения у GPT-5.6 Sol согласно отчету?

AСогласно отчету, GPT-5.6 Sol имеет более медленную итеративную скорость разработки и совершает больше неудачных попыток, так как стремится решать более сложные задачи. Его подход к исследованию идей менее разнообразен по сравнению с Opus — он часто упорно движется в одном выбранном направлении. Кроме того, в некоторых аспектах, например, в создании готовых игр из одного промпта, он пока может отставать от Fable 5.

QКак OpenAI позиционирует GPT-5.6 Sol и для каких задач он лучше всего подходит?

AOpenAI позиционирует GPT-5.6 Sol как модель для сложных, многоэтапных задач, требующих глубоких рассуждений. Она лучше всего подходит для длительных рабочих процессов, которые включают планирование, итерации, вызов инструментов и координацию шагов. Это делает ее идеальной для сложного программирования, высокоуровневого анализа и других задач, где важна не просто генерация ответа, а глубокая оптимизация и последовательное выполнение.

Похожее

Попытки главы Минфина США обуздать доходность казначейских облигаций разожгли «валютные девальвационные сделки»! Золото достигло трёхмесячного максимума, биткоин за неделю взлетел более чем на 25%

Министр финансов США Джанет Йеллен предприняла попытку сдержать рост доходности долгосрочных казначейских облигаций, однако этот эффект оказался кратковременным. Вместо этого её действия спровоцировали ослабление доллара и резкий рост цен на золото и биткоин, что усилило логику торговли на обесценивание валюты. Основными драйверами этой динамики стали растущий дефицит бюджета США и структурное давление на долгосрочные процентные ставки, вызванное масштабными государственными заимствованиями и огромным спросом на капитал со стороны компаний, особенно в сфере ИИ. Биткоин за неделю вырос более чем на 25%, достигнув $78 000, а золото обновило трёхмесячный максимум. Корреляция между биткоином и золотом находится на самом высоком уровне со времён пандемии, укрепляя восприятие криптовалюты как инструмента хеджирования. Эксперты отмечают, что действия Казначейства могут повлиять на ликвидность, но не способны подавить фундаментальные факторы, такие как инфляция и спрос на капитал. Рэй Далио из Bridgewater рекомендовал инвесторам сокращать вложения в облигации и увеличивать долю золота и биткоина на фоне рисков долгового кризиса. Хотя повествование о торговле на обесценивание привлекательно, некоторые аналитики сомневаются в устойчивости текущего роста, указывая на отсутствие новых катализаторов. Внимание рынка теперь приковано к отчёту Nvidia и предстоящему симпозиуму в Джексон-Хоуле, где станет ясно, смогут ли прибыли компаний ИИ продолжать поддерживать рынки и будут ли действия ФРС согласованы с желанием Вашингтона сохранять низкие процентные ставки.

华尔街日报1 ч. назад

Попытки главы Минфина США обуздать доходность казначейских облигаций разожгли «валютные девальвационные сделки»! Золото достигло трёхмесячного максимума, биткоин за неделю взлетел более чем на 25%

华尔街日报1 ч. назад

Александр Шохин: бизнесу нужна ставка ниже 10% и доллар на уровне 90–95 рублей

Глава Российского союза промышленников и предпринимателей Александр Шохин вновь высказался за возможное использование "нерыночных" инструментов для удержания курса рубля в заданном коридоре, чтобы избежать чрезмерной волатильности. Ранее он уже отмечал, что текущий курс сложно назвать полностью рыночным. Шохин обозначил целевые ориентиры для бизнеса к концу 2026 года: ключевая ставка Банка России на уровне 12%, инфляция 4-5% и курс доллара в районе 90-95 рублей. При этом комфортным для инвестиций бизнес видит снижение ставки ниже 10%. Он подчеркивает прямую связь между стабильностью валюты, уровнем ставки, инфляцией и готовностью компаний инвестировать в новые проекты. Исторически валютный коридор в России уже применялся в 1995-1998 годах, но его удержание требовало значительных резервов и завершилось резким расширением границ во время кризиса. Вопрос о конкретных механизмах и источниках интервенций для поддержания такого коридора в текущих условиях остается открытым.

cryptonews.ru3 ч. назад

Александр Шохин: бизнесу нужна ставка ниже 10% и доллар на уровне 90–95 рублей

cryptonews.ru3 ч. назад

Поезд к Биткоину уже ушёл со станции? Пользовательский индикатор перестал подавать сигналы!

Рост цены биткоина вывел индикатор AHR999 из зоны «покупки на спаде» (значение ниже 0,45), где он находился примерно 82 дня — с 29 мая по 19 августа. После недавнего повышения стоимости BTC индикатор достиг отметки 0,5073 и вернулся в зону средней долларовой стоимости (DCA), которая находится в диапазоне от 0,45 до 1,20 и считается областью для устойчивых покупок. Индикатор AHR999 помогает долгосрочным инвесторам, использующим стратегию постепенного накопления, оценивать относительную дешевизну или дороговизну рынка, анализируя краткосрочную доходность и отклонение цены от расчетной стоимости. Исторически значения ниже 0,45 интерпретируются как «покупка на спаде», от 0,45 до 1,20 — как зона для планомерных покупок, а выше 1,20 — как область относительно высокой цены. При этом индикатор не является прямым сигналом к действиям на рынке.

cryptonews.ru3 ч. назад

Поезд к Биткоину уже ушёл со станции? Пользовательский индикатор перестал подавать сигналы!

cryptonews.ru3 ч. назад

Торговля

Спот

Популярные статьи

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на SOL (SOL) представлены ниже.

活动图片