¿Rubin Ultra recorta especificaciones? ¿Ni siquiera NVIDIA puede soportar el aumento del precio de la memoria?

Odaily星球日报Publicado a 2026-08-03Actualizado a 2026-08-03

Resumen

El informe de SemiAnalysis ha desencadenado un intenso debate en la industria de la IA al revelar posibles ajustes importantes en las especificaciones de Rubin Ultra, la próxima GPU flagship de NVIDIA para IA. Según el informe, Rubin Ultra mantendría el mismo pico teórico de potencia computacional (35 PFLOPs) que Rubin, pero sufriría una reducción significativa en la memoria: se especificaría con 192GB HBM apilado en 8 capas (8-Hi), incluso menos que los 288GB (12-Hi) de Rubin. El ancho de banda de memoria solo aumentaría ligeramente (1 TB/s), y el consumo energético sería similar o ligeramente superior. La mejora principal se centraría en la capacidad de interconexión a escala, soportando clusters de hasta 576 GPUs unidas mediante NVLink (frente a 72 en Rubin), creando un "super-GPU lógico". La causa principal de esta revisión sería el rápido aumento del precio de la memoria HBM, cuyo costo se habría triplicado desde 2025, impactando fuertemente el costo total de los sistemas. Al reducir la cantidad de HBM (bajando su participación en el costo del ~40% al ~28%) e invertir más en la interconexión (subiendo del 4% al 12%), NVIDIA optimizaría la relación costo-rendimiento del sistema completo. Esta noticia provocó una caída de aproximadamente el 8% en las acciones de los principales fabricantes de HBM, SK Hynix y Samsung, reflejando la preocupación del mercado sobre un posible punto de inflexión en la demanda de memoria de alta gama por parte del mayor comprador, NVIDIA, y ...

Original | Odaily星球日报(@OdailyChina)

Autor|Azuma(@azuma_eth)

El pasado fin de semana, un informe de la conocida firma de investigación de inversiones SemiAnalysis generó un intenso debate en toda la industria de la IA.

El contenido central del informe es que, tras la revelación de SemiAnalysis a finales de junio de que el diseño original de 4 chips (4-die) de Rubin Ultra de NVIDIA sería reducido a la mitad, la firma ha vuelto a revelar que NVIDIA ha proporcionado una vista previa de Rubin Ultra a sus principales clientes, pero sus especificaciones han disminuido aún más respecto a las expectativas anteriores.

A continuación, se presenta una captura de pantalla de la información relacionada con Rubin Ultra filtrada en el informe de SemiAnalysis:

  • Rubin Ultra mantendrá el mismo pico teórico de potencia de cálculo que Rubin, ambos de 35 PFLOPs;
  • Recorte severo en la capacidad de memoria gráfica, las especificaciones se reducen a 192GB con apilamiento de 8 capas (8-Hi), incluso por debajo de los 288GB con apilamiento de 12 capas (12-Hi) de Rubin;
  • El ancho de banda de memoria apenas cambia, solo aumenta 1 TB/s, prácticamente insignificante en cálculos reales de alto rendimiento;
  • El consumo energético a nivel de chip incluso aumenta ligeramente, el consumo mínimo es el mismo que el de Rubin (1800 W), el máximo es aún mayor (2600 W);
  • La única mejora significativa es la "escala de interconexión de expansión" (Scale-up world size), que aumenta de 72 GPUs a 576 GPUs, lo que significa que NVIDIA ha trasladado el verdadero punto de venta a la red de clústeres. A través de la red NVLink, puede conectar hasta 576 Rubin Ultra para formar un enorme "super GPU lógica" (la versión estándar solo admite la interconexión de hasta 72 tarjetas).

Como la versión insignia de gama alta de Rubin, anunciada con gran expectación por NVIDIA en GTC 2026, Rubin Ultra estaba originalmente diseñada para integrar más chips (die) y memoria de alto ancho de banda, específicamente para satisfacer las necesidades de entrenamiento e inferencia de modelos de IA a escala extrema. Sin embargo, según los detalles de especificaciones revelados más recientemente por SemiAnalysis, NVIDIA ha ajustado claramente el enfoque de diseño de Rubin Ultra.

El HBM sube demasiado rápido, NVIDIA comienza a replantearse las cuentas

En los últimos dos años, uno de los componentes más críticos en la expansión de la industria de la IA ha sido, sin duda, el HBM.

Con la explosión de demanda de aceleradores de IA como Nvidia H100, H200, Blackwell, la memoria de alto ancho de banda pasó de ser un producto de almacenamiento de alta gama relativamente nicho a convertirse en el eslabón más escaso en toda la infraestructura de IA. SK Hynix, Samsung y Micron, mientras batían récords de resultados, aumentaron sus inversiones en HBM. El desequilibrio entre oferta y demanda del mercado continúa impulsando el alza de precios del HBM.

Para los fabricantes de chips de IA, la importancia del HBM es evidente: la GPU se encarga del cálculo, el HBM proporciona el alto rendimiento de datos; ambos determinan conjuntamente la eficiencia del entrenamiento e inferencia de modelos de IA. Pero el problema es que el HBM ya se ha encarecido hasta el punto de empezar a afectar la economía general del sistema de IA. Tomando como ejemplo el HBM3, el precio de un HBM3 en el punto más bajo del Q2 de 2025 era de solo 180-220 dólares, en el Q1 de este año (precio de contrato) ya había subido a 600-700 dólares, y en el Q2 (precio spot) incluso a 700 - 850 dólares.

Según los cálculos de SemiAnalysis, con el aumento del precio del HBM, el costo puro de materiales (BOM) por bastidor de Rubin Ultra pasó de aproximadamente 6.6 millones de dólares a 8 millones, y tras ajustar las especificaciones de diseño, el costo puede retroceder a unos 6.4 millones de dólares.

Para NVIDIA, una diferencia de coste tan enorme plantea un problema muy real: si continúa aumentando la capacidad de HBM según el diseño original, ¿seguirá proporcionando una mejora de rendimiento que justifique el coste? ¿Existe alguna otra solución más óptima?

SemiAnalysis responde a esto en su informe. El ajuste de Rubin Ultra es, en esencia, una reoptimización por parte de NVIDIA de la estructura de costes del sistema de IA con recursos limitados. Es decir, reducir la configuración de HBM relativamente cara (su porcentaje de coste baja de cerca del 40% al 28%) y destinar recursos a capacidades de interconexión de expansión de mayor valor (su porcentaje de coste sube del 4% al 12%).

Como se mencionó anteriormente, la dirección central de actualización de Rubin Ultra se ha reorientado ahora hacia la "capacidad de interconexión de expansión a nivel de sistema". La arquitectura NVL576 admitida por Rubin Ultra puede conectar hasta 576 GPUs mediante NVLink para formar un dominio de computación unificado, con el objetivo de compensar los ajustes en las especificaciones de un solo chip mediante una expansión del sistema a mayor escala.

Caída de las acciones de memoria, el mercado teme que la demanda haya tocado techo

Posiblemente impactadas por esta noticia, las acciones del sector de la memoria abrieron a la baja esta mañana en la bolsa surcoreana. Hasta las 11:45 hora de Beijing, SK Hynix y Samsung, los dos líderes en HBM, cayeron alrededor de un 8%, y el índice KOSPI también cayó aproximadamente un 5%.

El mercado ya comienza a preocuparse de que, si los ajustes de especificaciones de Rubin Ultra revelados por SemiAnalysis son ciertos (NVIDIA aún no ha confirmado públicamente la información), ¿significaría que NVIDIA, como el comprador central más importante en la infraestructura de IA, está reduciendo su demanda de HBM?

En los últimos dos años, con el rápido crecimiento de la demanda de expansión de la IA, el HBM se ha convertido en la parte más escasa de la infraestructura de IA. NVIDIA, AMD y otros fabricantes de chips han seguido aumentando la configuración de HBM en sus aceleradores de IA, impulsando el espectacular crecimiento de los resultados de fabricantes de memoria como SK Hynix, Samsung y Micron, y reforzando continuamente su poder de fijación de precios en toda la cadena industrial.

La elección de NVIDIA podría significar que los fabricantes de chips de IA están considerando optimizar el diseño del hardware para reducir la dependencia de un solo chip de HBM de alta capacidad. Si este camino demuestra ser viable, es muy probable que el espacio para continuas subidas de precios por parte de los fabricantes de HBM se vea limitado.

La construcción de la infraestructura de IA tarde o temprano se despedirá de la era de la "acumulación frenética de especificaciones y el aumento de precios irreflexivo". Y ahora, incluso NVIDIA, sentada en el trono de hierro de la potencia de cálculo, ha comenzado a ser más cuidadosa con los costes.

Preguntas relacionadas

Q¿Cuáles son las principales especificaciones del Rubin Ultra de NVIDIA según el informe de SemiAnalysis?

ASegún el informe de SemiAnalysis, las especificaciones clave del Rubin Ultra son: potencia teórica máxima de 35 PFLOPs (igual que Rubin), memoria gráfica reducida a 8 capas apiladas (8-Hi) y 192 GB, ancho de banda de memoria prácticamente sin cambios (solo 1 TB/s más), potencia del chip ligeramente superior (hasta 2600 W) y una gran mejora en la interconexión de escala, que soporta hasta 576 GPUs conectadas mediante NVLink.

Q¿Por qué NVIDIA está reduciendo la configuración de HBM en el Rubin Ultra?

ANVIDIA está reduciendo la configuración de HBM (High Bandwidth Memory) en el Rubin Ultra principalmente debido al rápido aumento de los precios de la memoria HBM. Este encarecimiento está afectando la rentabilidad general del sistema de IA, por lo que la compañía está optimizando la estructura de costes, reduciendo la dependencia de HBM y reasignando recursos hacia capacidades de interconexión más valiosas.

Q¿Qué impacto tuvo el informe sobre Rubin Ultra en el mercado de valores de las empresas de memoria?

AEl informe sobre la reducción de especificaciones del Rubin Ultra provocó una caída en las acciones de empresas de memoria. En la apertura del mercado surcoreano, SK Hynix y Samsung, los dos principales fabricantes de HBM, cayeron aproximadamente un 8%, y el índice KOSPI bajó alrededor de un 5%. El mercado teme que NVIDIA, como comprador clave, esté reduciendo su demanda de HBM.

Q¿Cuál es el cambio principal en la arquitectura de interconexión del Rubin Ultra?

AEl cambio principal en la arquitectura de interconexión del Rubin Ultra es la introducción de la arquitectura NVL576, que permite conectar hasta 576 GPUs mediante NVLink para formar un único dominio de computación unificado. Esta mejora busca compensar los ajustes en las especificaciones individuales del chip mediante una mayor escalabilidad a nivel de sistema.

Q¿Cómo ha evolucionado el precio de la memoria HBM3 según el artículo?

ASegún el artículo, el precio de la memoria HBM3 ha experimentado un aumento significativo: en el segundo trimestre de 2025, el precio bajo era de 180-220 dólares; en el primer trimestre de 2026 (precio contractual), subió a 600-700 dólares; y en el segundo trimestre de 2026 (precio spot), alcanzó los 700-850 dólares.

Lecturas Relacionadas

La industria tecnológica china está cruzando masivamente la "línea de visibilidad"

Un fenómeno notable emerge en el sector tecnológico chino: múltiples industrias están superando de manera concentrada la "línea de visibilidad", pasando de acumular capacidades internas a ser reconocidas globalmente. Sectores como la inteligencia artificial, la robótica y los medicamentos innovadores ("los tres nuevos nuevos") se unen a los anteriores "tres nuevos" (vehículos eléctricos, baterías, fotovoltaica) en el radar mundial. ¿Qué define esta línea de visibilidad? Cuando una industria alcanza una escala significativa (cientos de miles de millones), demuestra ventajas claras en participación de mercado o rendimiento, acelera su crecimiento e impulsa cadenas de suministro completas. El cruce de esta línea marca la transición del desarrollo interno a influir en las elecciones del mercado global. Los ciclos se están acortando. Mientras que desde los textiles hasta los "tres nuevos" pasaron décadas, los "tres nuevos nuevos" han emergido en pocos años. Este ritmo refleja una capacidad de innovación china que evoluciona al unísono con la vanguardia global y una mayor capacidad para definir nuevos productos y mercados, no solo para ingresar en ellos existentes. ¿El motor interno? Un sistema industrial que ha pasado de ser "completo" a ser "denso": las capacidades acumuladas en una industria (p. ej., baterías y fabricación de precisión para coches eléctricos) se transfieren rápidamente a otras adyacentes (p. ej., robótica). La cercanía entre I+D y producción, la capacidad de organizar sistemas complejos (como los clústeres de computación) y las reformas regulatorias acortan el camino al mercado. La escala industrial se convierte en una infraestructura que genera continuamente nuevas industrias. El significado es profundo: la ventaja competitiva china se extiende de "fabricar productos" a establecer sistemas de conocimiento y organización que generan valor sostenible. Más allá del producto tangible, la clave reside en patentes, estándares y ecosistemas. China busca construir esta "zanja industrial" no mediante el cierre, sino a través de modelos abiertos (código abierto, interfaces API) que amplíen el ecosistema y fomenten la iteración tecnológica continua. Superar la "línea de visibilidad" es el comienzo de la validación del mercado. La aparición constante de nuevas industrias que la cruzan indica que China está desarrollando la capacidad sostenible de generarlas. Lo visible arriba son nuevos brotes industriales; debajo, persiste la continua acumulación y crecimiento de capacidades fundamentales a largo plazo.

marsbitHace 25 min(s)

La industria tecnológica china está cruzando masivamente la "línea de visibilidad"

marsbitHace 25 min(s)

Forbes: 7 millones de bitcoins expuestos al riesgo de la computación cuántica, ¿debe el BTC cambiar su 'cerradura'?

**Resumen: La carrera cuántica de los 470 mil millones de dólares y el futuro de Bitcoin** Un artículo de Forbes analiza la amenaza emergente que la computación cuántica supone para Bitcoin, estimando que unos 7 millones de BTC (valorados en ~470.000 millones de dólares) están en direcciones con claves públicas expuestas en la cadena. Esto incluye direcciones de la era de Satoshi y direcciones reutilizadas. Aunque la exposición no equivale a un robo inmediato, los avances son rápidos. Investigaciones recientes de Google han reducido significativamente la estimación de qubits necesarios para romper la criptografía de curva elíptica de Bitcoin. El investigador de Ethereum Foundation, Justin Drake, estima un 10% de probabilidad de que una computadora cuántica pueda descifrar claves privadas a partir de claves públicas expuestas para 2032. La comunidad de desarrolladores de Bitcoin está dividida sobre cómo responder. Las propuestas BIP-360 y BIP-361 ofrecen soluciones diferentes, siendo la última más radical al proponer la inutilización gradual de monedas en direcciones antiguas no migradas. Mientras tanto, varias startups están "adelantándose" al problema. **American Fortress** (antes MatterFi) afirma ofrecer resistencia cuántica sin necesidad de migrar direcciones, aunque su trabajo no ha sido publicado ni auditado públicamente. Otras, como BOLTS Technologies, abogan por dar a los usuarios la opción de elegir su criptografía ("trae tu propia cerradura"). El artículo concluye con un escepticismo cauteloso, comparando algunas afirmaciones con el "descubrimiento de la fusión fría" y subrayando que, aunque el riesgo es real, la máquina capaz de explotarlo aún no existe. La carrera para asegurar las cadenas de bloques contra este futuro posible ha comenzado.

marsbitHace 32 min(s)

Forbes: 7 millones de bitcoins expuestos al riesgo de la computación cuántica, ¿debe el BTC cambiar su 'cerradura'?

marsbitHace 32 min(s)

10.000 millones en recompra no logran frenar la caída de HYPE, ¿miembros clave y Multicoin venden en secreto?

Según un análisis de cadenas, el token HYPE ha experimentado una caída del precio de aproximadamente un 30% desde su máximo histórico de alrededor de 76 dólares en julio de 2026, cotizando actualmente a 52,4 dólares. A pesar de un programa de recompra de la Assistance Fund que ha superado los 10.200 millones de dólares—absorbiendo más del doble de la velocidad de venta del equipo—el sentimiento del mercado se ha visto presionado. Los datos muestran que desde diciembre de 2025, se asignaron aproximadamente 4,93 millones de HYPE (0,493% del suministro) a las carteras del equipo, con 1,19 millones vendidos en el mercado abierto y 3,14 millones transferidos a plataformas OTC. Sin embargo, las ventas reales del equipo son limitadas y controladas. La presión vendedora significativa proviene de otros actores. Fondos de capital de riesgo como Multicoin Capital y a16z han realizado importantes retiros de staking y transferencias a exchanges, aunque Multicoin citó razones de privacidad para la rotación de carteras. Simultáneamente, los ETF spot de HYPE han registrado salidas netas diarias sostenidas desde principios de julio, en contraste con las fuertes entradas de mayo y junio. En resumen, la corrección del precio de HYPE se atribuye a una combinación de ventas por parte de ballenas institucionales, salidas netas de ETF y una disminución en el ritmo de recompra del protocolo debido a un menor volumen de transacciones y ingresos, más que únicamente a las ventas del equipo central.

marsbitHace 50 min(s)

10.000 millones en recompra no logran frenar la caída de HYPE, ¿miembros clave y Multicoin venden en secreto?

marsbitHace 50 min(s)

WEEX API Fast Connect: Convierte Cada Inicio de Sesión en un Trader Activo en Menos de 10 Segundos

WEEX ha lanzado API Fast Connect, un sistema de autorización OAuth de un solo clic que permite a los usuarios vincular su cuenta de WEEX sin manejar manualmente una clave API. Diseñado específicamente para socios de WEEX Broker, reemplaza el proceso técnico tradicional de onboarding con una experiencia fluida, con el objetivo de impulsar conversiones más rápidas y una mayor retención a largo plazo. **Puntos clave:** * **Qué es:** Una autorización de un clic (similar a "Iniciar sesión con Google") para conectar la cuenta de WEEX a una plataforma asociada. * **Problema que resuelve:** Elimina el mayor punto de abandono: la configuración manual de claves API, que es compleja y propensa a errores. * **Beneficios:** Conversiones sin fricción, menor abandono, mayor retención. Los usuarios pasan de registrarse a operar en vivo en segundos. * **Para quién es:** Plataformas de señales de IA, herramientas de trading cuantitativo, bots de trading y cualquier socio de WEEX Broker que requiera acceso API. **Cómo funciona:** 1. El usuario hace clic en "Iniciar sesión con WEEX" en la plataforma asociada. 2. Es redirigido a una página de autorización oficial de WEEX para verificación. 3. Confirma el alcance de los permisos (operar y leer, pre-seleccionado). 4. El sistema genera y vincula automáticamente la clave API en el backend a través de un canal cifrado. El usuario nunca maneja la clave. **Ventajas clave:** * **Experiencia de usuario:** Proceso de un clic frente a un flujo manual y fragmentado. * **Seguridad:** Las claves se generan y transmiten cifradas en el backend, sin exponerse al usuario. * **Velocidad:** Vinculación instantánea tras la autorización. Fast Connect es parte del conjunto de herramientas para socios de WEEX Broker, que también incluye liquidez institucional, comisiones competitivas y acceso API completo. Su objetivo es convertir el interés del usuario en actividad comercial real de la manera más rápida y segura posible.

TheNewsCryptoHace 56 min(s)

WEEX API Fast Connect: Convierte Cada Inicio de Sesión en un Trader Activo en Menos de 10 Segundos

TheNewsCryptoHace 56 min(s)

Trading

Spot
活动图片