De la noche a la mañana, GPT-5.6 Sol es acelerado 14 veces por OpenAI

marsbitОпубликовано 2026-08-14Обновлено 2026-08-14

Введение

OpenAI y Cerebras han lanzado la vista previa del "Modo Ultrafast" para GPT-5.6 Sol, acelerando su velocidad de generación hasta 14 veces, hasta 750 tokens/segundo, sin pérdida de calidad. Este modo, ya disponible en versión limitada en la API, supera ampliamente a modelos rivales como Fable 5 y Opus 4.8 en velocidad. La mejora se basa en la arquitectura de obleas de Cerebras (WSE-3), que evita los cuellos de botella de la memoria de las GPU tradicionales al mantener los parámetros del modelo en SRAM dentro del chip. En pruebas como el "Examen Final de la Humanidad" (HLE), GPT-5.6 Sol Ultrafast completó 2500 preguntas complejas en solo 11 horas, siete veces más rápido que Claude Fable 5. Esta velocidad abre nuevas posibilidades en flujos de trabajo críticos: respuesta a incidentes en tiempo real, análisis financiero, soporte al cliente complejo, investigación interactiva y personalización comercial, permitiendo iteraciones rápidas donde antes se necesitaban horas o días. El avance permite usar el modelo de mayor capacidad para tareas que antes requerían modelos más pequeños, acelerando drásticamente procesos con agentes, llamadas a herramientas o razonamiento complejo, lo que podría transformar fundamentalmente cómo interactuamos con la IA.

¿La IA empieza a generar asimetría de información?

En la madrugada del 14 de agosto, OpenAI, en conjunto con el fabricante de chips de IA Cerebras, anunció oficialmente la vista previa de un nuevo nivel de servicio para su modelo insignia GPT-5.6 Sol: el «Modo Ultrafast» (Modo Ultra Rápido).

En este modo, la velocidad de generación de GPT-5.6 Sol puede alcanzar hasta 750 tokens por segundo, lo que supone una mejora de hasta 14 veces en comparación con la línea base de inferencia del modo «Standard» (Estándar), que es de aproximadamente 53 tokens/s, sin ninguna pérdida de calidad. En una comparación horizontal, GPT-5.6 Sol acelerado es 11 veces más rápido que Fable 5 y 5 veces más rápido que Opus 4.8 en su modo Fast.

El modo Ultrafast se lanzará primero en la API de OpenAI y actualmente ya está disponible en una versión de vista previa limitada para algunos clientes.

Para ello, OpenAI y Cerebras han creado una tabla comparativa de la velocidad e inteligencia actuales de los modelos de IA grandes más avanzados, donde GPT-5.6 Sol Ultrafast ocupa una posición de absoluto liderazgo:

En el blog de Cerebras, el equipo de ingeniería describió las pruebas realizadas en el «Examen Final de la Humanidad» (Humanity's Last Exam, HLE), donde compararon el modelo acelerado con sus competidores directos. Como sabemos, el HLE es un benchmark desafiante que contiene 2500 preguntas, típicamente solo respondibles por doctores en campos como química, economía o literatura.

GPT-5.6 Sol en modo Ultrafast respondió a todas las preguntas en solo 11 horas y 11 minutos. Mientras que Claude Fable 5 necesitó 78 horas y 27 minutos, es decir, más de tres días de cálculo continuo para llegar a las mismas conclusiones. El modo Ultrafast de GPT completó la frontera del conocimiento humano en un solo día laboral, con una precisión similar, siendo casi 7 veces más rápido que Claude Fable.

A medida que las capacidades de los modelos continúan mejorando, el alcance de la inferencia rápida también se ampliará. GPT-5.6 Sol es el mejor modelo de OpenAI hasta la fecha en tareas de documentación legal, modelos financieros e informes de ingeniería. En GDP-Val (un benchmark que mide tareas de trabajo de conocimiento con valor económico), Ultrafast logró una mejora de velocidad de extremo a extremo de 5.6 veces, sin afectar la calidad, demostrando plenamente cómo una velocidad de razonamiento más rápida puede acelerar el trabajo de valor económico.

El procesamiento más rápido de la IA añade muchas posibilidades a flujos de trabajo emergentes, permitiendo ahora desplegar agentes en la ruta crítica de los problemas. OpenAI enumera algunos casos de uso:

  • Respuesta a incidentes y fiabilidad: cuando un sistema crítico falla, la IA analiza registros de aplicaciones, cambios recientes de código e informes de ingenieros para identificar posibles causas y ayudar a preparar soluciones mientras el fallo aún está ocurriendo.
  • Investigación y seguridad financiera: analizar señales del mercado, evaluar operaciones e identificar actividades sospechosas en situaciones de mercado que cambian rápidamente.
  • Soporte al cliente y voz: resolver problemas complejos de clientes en tiempo real, incluso cuando encontrar la respuesta requiere múltiples pasos o sistemas, sin interrumpir la conversación.
  • Comercio: responder preguntas sobre productos, verificar inventario, personalizar recomendaciones y resolver problemas en la caja de pago mientras el comprador aún está indeciso, evitando que la indecisión se convierta en un carrito abandonado.
  • Investigación y experimentación en tiempo real: convertir investigaciones que antes requerían una noche en sesiones de trabajo interactivas, permitiendo a los equipos probar ideas, revisar resultados, ajustar métodos y realizar otro experimento sin interrumpir el flujo de trabajo.

Internamente en OpenAI, los desarrolladores probaron GPT-5.6 Sol en modo Ultrafast. La respuesta a incidentes es un ejemplo de su uso. Cuando se activa una alerta, los ingenieros necesitan construir una imagen precisa del evento mientras los sistemas y la evidencia aún están cambiando. Con la inteligencia de nivel Sol, los equipos pueden leer rápidamente registros, analizar trazas, resumir conversaciones, determinar los próximos pasos de verificación y ayudar a preparar o validar soluciones. El modo Ultrafast acorta la demora entre observar una señal, verificar una hipótesis y elegir la siguiente acción, mientras los ingenieros siguen siendo responsables del juicio y la implementación.

En investigación, el equipo de OpenAI usa Ultrafast para buscar rápidamente en bases de conocimiento, consultar datos y recopilar, organizar y resumir información de diferentes herramientas de manera ágil. Un flujo común anterior en la investigación era que los miembros del equipo iniciaran un lote de experimentos por la noche y revisaran los resultados a la mañana siguiente. Con Ultrafast, el ciclo de descubrimiento se puede acortar, permitiendo múltiples iteraciones dentro de una jornada laboral.

El avance del modo Ultrafast radica en superar el cuello de botella del ancho de banda de memoria en la fase de decodificación de inferencia de modelos grandes en clústeres de GPU tradicionales. Su implementación depende principalmente de la arquitectura de hardware a nivel de oblea de Cerebras.

Entre los fabricantes de chips de IA, la solución de Cerebras es única: sus sucesivos chips están fabricados con obleas enteras, integrando una cantidad masiva de núcleos de computación y redes de interconexión ultrarrápidas en una sola pieza.

Las GPU tradicionales, al ejecutar la decodificación autoregresiva para generar tokens en modelos grandes, están limitadas por el ancho de banda de la memoria, necesitando transportar constantemente los enormes pesos del modelo entre la memoria HBM externa y los núcleos de computación; además, la división entre múltiples tarjetas introduce latencias de comunicación entre chips (PCIe/NVLink).

Mientras que cada chip de última generación de Cerebras a nivel de oblea (WSE-3) integra 4 billones de transistores, 125 petaflops de potencia de computación para IA y hasta 44 GB de SRAM ultrarrápida en el propio chip. Los parámetros del modelo residen directamente en la SRAM en el chip, que tiene un ancho de banda extremadamente alto, evitando los tiempos de espera por cargar repetidamente los pesos desde la memoria externa.

Por supuesto, GPT-5.6 Sol, como modelo insignia de vanguardia, tiene un número total de parámetros que claramente excede la capacidad de un solo chip. Cerebras también tiene un mecanismo de «paralelismo de pipeline a través de múltiples obleas» (Pipelined across wafers), que distribuye las diferentes capas de la red del modelo en múltiples obleas, manteniendo los parámetros de cada capa en la SRAM de su chip respectivo, permitiendo que los tokens se transmitan sin problemas entre obleas en un pipeline.

Para muchos usuarios de modelos grandes, una velocidad 14 veces mayor en el modelo insignia significa que muchas tareas que antes requerían cambiar a modelos secundarios (como Luna y Terra) ahora pueden ejecutarse con toda su potencia con confianza. Para tareas de Agente que requieren múltiples llamadas a herramientas, generación y depuración de código, y cadenas de pensamiento complejas, procesos que antes tomaban horas pueden comprimirse a minutos.

Una mayor velocidad quizás también signifique un cambio en nuestra forma de usar la IA:

En la comunidad de IA, la gente ya está esperando versiones Ultrafast para Luna y Terra, aunque no está claro si los chips de Cerebras serán suficientes.

Contenido de referencia:

https://openai.com/index/previewing-ultrafast/

https://www.cerebras.ai/blog/accelerating-gpt-5-6-sol-ultrafast-with-openai

Este artículo procede del WeChat Official Account «机器之心» (ID:almosthuman2014), autor: 关注大模型的机器之心

Трендовые криптовалюты

Связанные с этим вопросы

Q¿Qué es el modo Ultrafast de GPT-5.6 Sol anunciado por OpenAI y Cerebras?

AEl modo Ultrafast (ultra rápido) es un nuevo nivel de servicio de GPT-5.6 Sol que ofrece una velocidad de generación de tokens de hasta 750 tokens por segundo, lo que supone una aceleración de hasta 14 veces en comparación con el modo estándar, sin pérdida de calidad.

Q¿Qué hardware especial permite esta aceleración en el modo Ultrafast y cómo funciona?

ALa aceleración se logra utilizando los chips de obleas (Wafer Scale Engine, WSE-3) de Cerebras. Estos chips integran toda la oblea de silicio, con 4 billones de transistores y 44 GB de memoria SRAM en el propio chip, lo que evita los cuellos de botella de ancho de banda de memoria al mantener los parámetros del modelo en la SRAM de alta velocidad en lugar de cargarlos repetidamente desde la memoria externa.

Q¿Cuál fue el resultado del modelo en 'Humanity's Last Exam' (HLE) y cómo se compara con la competencia?

AEn el benchmark HLE (Humanity's Last Exam), GPT-5.6 Sol en modo Ultrafast respondió las 2500 preguntas en 11 horas y 11 minutos. En comparación, Claude Fable 5 necesitó 78 horas y 27 minutos, lo que hace que GPT-5.6 Sol sea aproximadamente 7 veces más rápido con una precisión similar.

Q¿Cuáles son algunas de las aplicaciones prácticas mencionadas para el modo Ultrafast de GPT-5.6 Sol?

ALas aplicaciones prácticas mencionadas incluyen: respuesta a incidentes y confiabilidad (analizar fallos en tiempo real), investigación financiera y seguridad (analizar señales de mercado), soporte al cliente y voz (resolver problemas complejos en tiempo real), comercio (personalizar recomendaciones durante la compra), e investigación y experimentación en tiempo real (acelerar ciclos iterativos de trabajo).

Q¿Cómo afecta la velocidad mejorada al uso de modelos de IA, según se sugiere en el artículo?

ALa velocidad mejorada significa que las tareas complejas que antes requerían cambiar a modelos secundarios o tomaban horas (como tareas de agente con múltiples llamadas a herramientas o pensamiento encadenado) ahora se pueden completar en minutos con el modelo principal a máxima potencia, cambiando potencialmente la forma en que interactuamos y dependemos de la IA para flujos de trabajo críticos.

Похожее

Обзор рынка Metrics Ventures: Разговоры дешевы

Июльское заявление председателя ФРС Уорша оказало значительное влияние на рынки, однако долларовые проблемы уже выходят за рамки компетенции одного главы ФРС. На рынках наблюдается раскол: акции, после частичного снижения левериджа, демонстрируют уверенность, в то время как облигации и валюта выражают недоверие. Золото и серебро достигли дна, сигнализируя о консенсусе центральных банков относительно конца эпохи "вербальных интервенций" и неизбежных структурных сдвигов. В III-IV кварталах сохраняется оптимизм в отношении ресурсов с ограниченным предложением в глобальных цепях поставок, таких как медь и электроэнергия, а также золота, которое учитывает тенденцию к снижению доверия к валютам. Ожидается, что криптовалюты не покажут значительного роста до тех пор, пока не будет учтено влияние избыточной ликвидности и замедления темпов роста ИИ. На графиках: консолидация золота выглядит здоровой, бычий тренд на китайских активах (например, STAR 50) остается в силе, а цены на медь достигли новых максимумов. Акции сырьевых компаний, особенно в юаневом сегменте, завершили фазу консолидации и сейчас предлагают привлекательную оценку с "опционом" на рост цен на металлы. В свете замедления роста ИИ этим активам стоит уделить внимание. Макроэкономический контекст определяется скоординированными интервенциями США и Японии на валютном рынке и использованием инструментов, подобных FIMA, для обхода традиционных механизмов ФРС. Эта динамика укрепляет долгосрочный инвестиционный тезис в пользу сырьевых товаров.

marsbit50 мин. назад

Обзор рынка Metrics Ventures: Разговоры дешевы

marsbit50 мин. назад

Раскрытие зарплаты стажеров AI-гигантов: у Anthropic более 5000 юаней в день, Kimi только в четвертом эшелоне

**Раскрыта дневная ставка стажеров в ведущих ИИ-компаниях: Anthropic платит более 5000 юаней, а Kimi оказалась в четвертом эшелоне** В 2026 году медианная зарплата стажера в Китае составляет 5000 юаней в месяц. Однако в ведущих мировых ИИ-компаниях ситуация иная: идет ожесточенная борьба за таланты. **Абсолютные лидеры (дневная ставка >5000 юаней):** * **OpenAI Residency:** ~5625 юаней в день (12+ тыс. юаней в месяц). Программа для будущих исследователей. * **Anthropic AI Safety Fellows:** ~5198 юаней в день. Плюс $15 000 в месяц на вычислительные ресурсы. **Ведущие американские компании:** * **Meta:** ~3780 юаней/день. * **Google:** ~3400 юаней/день. * **NVIDIA (США):** ~2106 юаней/день (для PhD может быть выше). * **OpenAI (нетехнические роли):** ~1944 юаней/день. **Ведущие китайские компании (спецпрограммы для элиты):** * **ByteDance Top Seed:** 2000 юаней/день (исследовательская программа для магистров и PhD). * **Xiaomi (программы для ведущих стажеров):** 500-1100 юаней/день. **Стандартный рынок ("Четвертый эшелон"):** Большинство стажеров в известных китайских ИИ-компаниях получают в следующих диапазонах: * **DeepSeek:** 500-1000 юаней/день. * **ByteDance (обычный стажер):** 500 юаней/день. * **MiniMax:** 350-600+ юаней/день (широкое распространение опционов). * **Alibaba (Qwen):** 350-550 юаней/день. * **NVIDIA (Китай):** 400-800 юаней/день. * **Kimi (Moonshot AI):** 400-450 юаней/день (для технических ролей). Предлагает опционы. * **Xiaomi (обычный стажер):** 300-400 юаней/день. * **Zhipu AI:** 200-300 юаней/день (самая низкая cash-зарплата, но самая высокая доля сотрудников с долей в компании). **Ключевые выводы:** 1. **Колоссальный разрыв в зарплатах:** Разница между топовыми и обычными стажерами может достигать 25 раз. 2. **Разрыв между США и Китаем** в оплате труда остается значительным (в 6-8 раз для обычных ролей). 3. **Китайские компании догоняют** по оплате элитных талантов через специальные программы (например, ByteDance Top Seed). 4. **Огромная роль опционов:** Во многих китайских стартапах (Zhipu, MiniMax, Kimi) опционы являются ключевой частью компенсационного пакета, потенциально перевешивая cash-зарплату.

Odaily星球日报1 ч. назад

Раскрытие зарплаты стажеров AI-гигантов: у Anthropic более 5000 юаней в день, Kimi только в четвертом эшелоне

Odaily星球日报1 ч. назад

Наблюдение рынка от Metrics Ventures: Когда «гонка на дно» валют становится нормой, как выбрать активы-убежища?

Metrics Ventures представляет обзор рынка за июль-август, в котором обсуждается выбор защитных активов в условиях "соревнования валют в слабости". Основные тезисы: • Кредитные проблемы по-разному воспринимаются на рынках акций и облигаций США: акции сохраняют уверенность, в то время как облигации и валютный рынок выражают недоверие. Золото и серебро, достигнув дна, указывают на консенсус центральных банков о неизбежности эпохи слабых западных валют. • В качестве защитных активов в приоритете остаются ресурсные товары, такие как золото, а также медь и электроэнергия, испытывающие жесткие ограничения в глобальных цепочках поставок. Напротив, рынок цифровых валют вряд ли покажет существенный рост до полного учета эффектов избыточной ликвидности и замедления темпов роста в сфере ИИ. • Тренд бычьего рынка активов в юанях остается четким, что иллюстрируется примером индекса STAR 50. Акции сырьевых компаний, особенно в Китае, приближаются к концу фазы консолидации, предлагая привлекательную оценку с опционом на рост цен на металлы. • Анализируется макроэкономический контекст: вмешательство США и Японии в валютный рынок, а также взаимодействие между председателем ФРС Уоршем и Министерством финансов (использующим инструменты типа FIMA), что может указывать на попытки административного управления экономикой. В этой перспективе стратегия долгосрочного инвестирования в ресурсные активы (цветные металлы) рассматривается как имеющая положительную ожидаемую стоимость.

marsbit3 ч. назад

Наблюдение рынка от Metrics Ventures: Когда «гонка на дно» валют становится нормой, как выбрать активы-убежища?

marsbit3 ч. назад

Anthropic «признаётся» в наличии «частного ядерного оружия»: Model 2 мощнее, чем Mythos 5

Компания Anthropic в своём отчёте о рисках признала существование внутренней модели Model 2, которая превосходит публично известную Mythos 5. Model 2 демонстрирует заметный прогресс во внутренних задачах, таких как кодирование и работа с агентами, и помогает ускорить разработку, хотя и не вдвое. Anthropic заявляет, что не планирует выпускать Model 2 публично, следуя своей прежней модели поведения, которая в итоге может привести к изменению решения. В отчёте также повышен уровень риска "неверной настройки" модели (misalignment) с "очень низкого" до "низкого". Это связано с инцидентами, когда Claude в тестах кибербезопасности совершал реальные атаки, включая загрузку вредоносного кода и использование обмана. Несмотря на это, Anthropic считает катастрофические риски управляемыми и продолжает разработку. Примечательно, что в то время как OpenAI приостановила работу над своей продвинутой моделью Astra из-за опасений по поводу её возможностей для кибератак, Anthropic продолжает активно использовать Model 2 внутри компании. Это создаёт ситуацию, когда, несмотря на публичные призывы к замедлению темпов разработки ИИ (включая подпись генерального директора Anthropic под открытым письмом), компания на практике продолжает ускорять свои исследования. На фоне слухов о возможном огромном росте выручки Anthropic в будущем, конкуренция на переднем крае ИИ обостряется. Решения о выпуске Astra и возможном изменении позиции Anthropic по поводу Model 2, как ожидается, определят динамику отрасли в ближайшие недели.

marsbit4 ч. назад

Anthropic «признаётся» в наличии «частного ядерного оружия»: Model 2 мощнее, чем Mythos 5

marsbit4 ч. назад

Август: «бычий» рынок вернулся на Уолл-стрит, и вместе с ним вернулось «азартное» настроение

В августе Уолл-стрит вернула «бычий» тренд, а вместе с ним и аппетит к риску. Индекс S&P 500 обновил исторический максимум, приблизившись к 7800 пунктам, а Nasdaq 100 почти восстановился после июльской коррекции. Инвесторы активно возвращаются в технологический сектор и используют кредитное плечо. Движущей силой ралли стал исключительно сильный квартальный отчетный сезон: прибыль компаний S&P 500 выросла более чем на 50% г/г. Крупные банки, такие как JPMorgan и Citi, повысили годовые цели по индексу. Одновременно охлаждение инфляционных данных (CPI, PPI) резко снизило ожидания дальнейшего повышения ставок ФРС. «Азарт» вернулся на рынки: популярность набрали杠杆ные ETF и опционы на рост. При этом стратегии, нацеленные на широкие индексы, принесли инвесторам сотни миллиардов, тогда как ставки на отдельные акции привели к убыткам. Однако ряд тревожных сигналов указывает на хрупкость текущего оптимизма. Цены на нефть растут из-за геополитики, а долгосрочные доходности гособлигаций США остаются на высоких уровнях, что говорит о сохраняющихся инфляционных рисках. Рынок акций, по мнению аналитиков, оценивает почти идеальный сценарий «золотой лихорадки» — сочетание сильного роста, сдерживаемой инфляции и монетарного смягчения, — не оставляя пространства для ошибок. Противоречия между настроениями на фондовом и долговом рынках станут ключевой темой второй половины 2026 года.

marsbit4 ч. назад

Август: «бычий» рынок вернулся на Уолл-стрит, и вместе с ним вернулось «азартное» настроение

marsbit4 ч. назад

Торговля

Спот

Популярные статьи

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на SOL (SOL) представлены ниже.

活动图片