Artículos Relacionados con GPU

El Centro de Noticias de HTX ofrece los artículos más recientes y un análisis profundo sobre "GPU", cubriendo tendencias del mercado, actualizaciones de proyectos, desarrollos tecnológicos y políticas regulatorias en la industria de cripto.

Sin Tencent, ¿qué le queda a Suiyuan?

Si mañana Tencent dejara de comprar, ¿cuánto valdría aún Enflame? Este es el tema implícito en su prospecto de OPI. En 2025, el 74.9% de sus ingresos (más del 80% bajo otro criterio) provino de Tencent. Su exitosa aprobación para cotizar en la Bolsa de Ciencia y Tecnología completa la entrada al mercado de capitales de los "Cuatro Dragones" chinos de GPU, señalando una transición en el sector: del financiamiento por historias a la entrega real de pedidos. Enflame eligió un camino distinto: priorizar la entrega a grandes clientes sobre el relato. Su crecimiento explosivo (ingresos de 9.900 millones en 2025 y 2.870 millones en Q1 2026) refleja la liberación concentrada de pedidos de un supercliente. La dependencia del 83.79% con Tencent no es solo un riesgo; es el resultado de una estrategia industrial. Ante la enorme demanda de potencia de cálculo para sus modelos de IA (como Hunyuan), Tencent necesita un sistema de suministro estable y controlable. Más que comprar chips, compra seguridad. Esta relación trasciende la transacción. Tencent, principal accionista (20.26%) y cliente, está cultivando a su proveedor, similar a cómo los grandes clientes nutrieron a NVIDIA. Reemplazar a Enflame conllevaría un costo enorme al estar integrado en la infraestructura crítica. Así, la alta concentración se convierte en una barrera ecológica. El sector de chips de IA muestra tres capas: NVIDIA (regulador global), Huawei Ascend (jugador nacional) y los actores comerciales como Enflame. Esta empresa se está consolidando como la **base de cálculo del ecosistema Tencent**. Su plan de financiación (6.000 millones para I+D de chips de 5ª/6ª generación) está alineado con la hoja de ruta de Tencent. El caso de Enflame simboliza un cambio en la industria china de IA: ya no se trata solo de quién puede fabricar un chip, sino de quién puede integrarse en la cadena de suministro de un supercliente. Su valor no reside solo en la tecnología, sino en poseer un pedido masivo y creciente del mayor proveedor de internet de China. La lección final: la tecnología se puede perseguir, pero la confianza, los escenarios y los pedidos se ganan uno a uno. Esta es la única vía a largo plazo.

marsbit06/15 23:20

Sin Tencent, ¿qué le queda a Suiyuan?

marsbit06/15 23:20

La IA recursiva de la que advierte Anthropic, la nueva compañía de Tianyuandong acaba de dar el «primer paso»

Anthropic advirtió recientemente sobre la trayectoria hacia la "mejora recursiva automática" de la IA, donde los sistemas diseñan y entrenan sus propias versiones posteriores. Ahora, Recursive Superintelligence, una nueva empresa cofundada por Yuan Dong Tian (ex Meta FAIR), ha dado su "primer paso" hacia la investigación automatizada de IA. Han desarrollado un sistema de descubrimiento de conocimiento abierto y automatizado, logrando resultados de última generación (SOTA) en tres benchmarks distintos. El sistema automatiza el ciclo de investigación: generar ideas, implementar código, ejecutar experimentos y aprender para decidir el siguiente paso, reduciendo la dependencia de investigadores humanos. En el benchmark *NanoChat Autoresearch* (entrenamiento eficiente con presupuesto fijo), su sistema mejoró el resultado, necesitando un 30% menos de tiempo para lograr la misma calidad. En *NanoGPT Speedrun* (entrenamiento más rápido), redujo el tiempo récord de 79.7 a 77.5 segundos mediante optimizaciones como cálculo de atención en FP8 y un kernel MLP fusionado más eficiente. Finalmente, en *SOL-ExecBench* (optimización de kernels GPU), mejoró la puntuación general de 0.699 a 0.754, acercándose un 18% más al límite teórico del hardware. Recursive, que cuenta con un equipo de renombre y una fuerte financiación, busca construir sistemas de IA que mejoren recursivamente su propia capacidad de investigación. Este trabajo representa una concreción temprana del paradigma de "IA recursiva". Mientras Anthropic urge precaución y coordinación ante este camino, empresas como Recursive ya están avanzando por él, aunque reconocen que este es solo un primer paso en escenarios bien definidos.

marsbit06/12 04:16

La IA recursiva de la que advierte Anthropic, la nueva compañía de Tianyuandong acaba de dar el «primer paso»

marsbit06/12 04:16

Broadcom vs AMD, ¿cuál es la acción de chips de IA más prometedora después de Nvidia?

**Resumen: Broadcom vs AMD en chips de IA** Fuera de Nvidia, la batalla por el segundo lugar en chips de IA se intensifica. AMD compite directamente en GPUs de uso general, mientras que Broadcom sigue una estrategia diferenciada con chips personalizados (XPU), atrayendo a clientes clave como Anthropic, Google, Meta y OpenAI. Aunque AMD reportó un crecimiento sólido (57% interanual en ingresos del centro de datos en Q1 2026), enfrenta la fuerte barrera del ecosistema de software CUDA de Nvidia. En cambio, Broadcom diseña chips a medida para cargas de trabajo específicas, ofreciendo mayor eficiencia y una relación más estrecha con los clientes. Este enfoque puede volverse más crucial a medida que la demanda de potencia de cálculo se desplaza del entrenamiento a la inferencia. Tras sus últimos resultados, las acciones de Broadcom cayeron debido a una guía de ingresos por IA para el próximo trimestre inferior a lo esperado. Sin embargo, su CEO, Hock Tan, reafirmó el objetivo de alcanzar 100.000 millones de dólares en ventas anuales de chips de IA para el año fiscal 2027. Con ingresos actuales por IA de 10.800 millones en el último trimestre, el potencial de crecimiento es significativo. A pesar de que Broadcom tiene una valoración más elevada que AMD, los analistas argumentan que esta prima está justificada dados sus clientes de primer nivel y sus perspectivas de crecimiento más rápidas.

marsbit06/09 14:57

Broadcom vs AMD, ¿cuál es la acción de chips de IA más prometedora después de Nvidia?

marsbit06/09 14:57

Más allá del "Muro de la Memoria": La Revolución a Escala de Oblea y la Ruta de la Capacidad Computacional en la Era del Razonamiento de IA

En 2026, el gasto de capital de los grandes proveedores de nube en inferencia de IA superó por primera vez al de entrenamiento, marcando un punto de inflexión hacia el uso de modelos grandes. La inferencia enfrenta la "barrera de memoria", donde el movimiento de datos (pesos del modelo, activaciones, KV Cache) entre la DRAM externa y las GPU consume más energía y tiempo que el cálculo en sí. Empresas como Cerebras abordan esto con un enfoque radical: el Wafer-Scale Engine (WSE). En lugar de cortar una oblea en múltiples chips, usan casi toda la oblea como un solo chip gigante (ej. WSE-3). Esto proporciona 44 GB de SRAM en el chip y un ancho de banda de memoria interno masivo (21 PB/s), miles de veces mayor que el HBM de las GPU, reduciendo drásticamente la latencia para cargar pesos del modelo. En inferencia, esto permite una generación de tokens entre 1.5 y 5 veces más rápida que una GPU NVIDIA B200 en ciertos modelos, con una ventaja notable en el tiempo para el primer token (TTFT) y cargas de trabajo de agentes. Su arquitectura también reduce drásticamente el consumo energético de la interconexión. Sin embargo, este enfoque conlleva desafíos: la capacidad de SRAM ya no escala fácilmente con procesos más avanzados, presenta retos de refrigeración, un ecosistema de software propietario y un ancho de banda de E/S externo limitado (150 GB/s) que dificulta la expansión multi-chip. Mientras tanto, los grandes actores persiguen otras rutas: chips ASIC especializados (Google TPU, Microsoft Maia), tecnologías de empaquetado avanzado estandarizadas (como SoW de TSMC) que podrían democratizar el concepto de "wafer-scale", y la interconexión óptica como solución a largo plazo para la barrera de memoria. Cerebras también enfrenta el reto comercial de cumplir grandes pedidos, teniendo que construir centros de datos especializados para 2026-2028. En última instancia, la arquitectura de computación se trata de equilibrar ventajas: Cerebras optimiza para la latencia extrema en cargas específicas, mientras que NVIDIA prioriza la flexibilidad y el rendimiento agregado del clúster para cargas diversas. El camino hacia la AGI sigue abierto y la incertidumbre tecnológica y comercial es precisamente lo que impulsa la innovación.

marsbit06/05 11:12

Más allá del "Muro de la Memoria": La Revolución a Escala de Oblea y la Ruta de la Capacidad Computacional en la Era del Razonamiento de IA

marsbit06/05 11:12

La CPU, regresando sigilosamente al centro del escenario de la potencia computacional de IA

En los últimos tres años, la narrativa del cómputo de IA se centró casi exclusivamente en las GPU. Sin embargo, a partir de 2026, esta visión está cambiando. A medida que las cargas de trabajo de IA evolucionan desde el entrenamiento de modelos a gran escala hacia la inferencia masiva y la ejecución de agentes inteligentes, surge un nuevo cuello de botella: la orquestación, la concurrencia y el flujo de datos. El CPU está recuperando un papel central, no como proveedor principal de cómputo paralelo, sino como el "plano de control" de la infraestructura de IA. Este cambio es impulsado por la necesidad de gestionar miles de tareas ligeras, peticiones de inferencia y agentes simultáneamente, tareas para las cuales la arquitectura de GPU no está optimizada. Un ejemplo concreto: en los centros de datos de IA avanzados, como el proyecto "Fairwater" de Microsoft para OpenAI, extensos clusters de CPU son necesarios para sostener y gestionar las operaciones de los masivos clusters de GPU, manejando el flujo de datos y la planificación de tareas. Intel, con su nuevo procesador Xeon 6+ (fabricado en su proceso Intel 18A y con hasta 288 núcleos de eficiencia -E-cores), apuesta precisamente por este nicho. Su diseño prioriza la alta densidad de núcleos y la eficiencia energética para manejar cargas de trabajo de alto rendimiento y alta concurrencia propias de la inferencia y los agentes de IA. Sin embargo, el éxito de este "regreso del CPU" no está garantizado para Intel. Enfrenta una competencia multifacética: las soluciones integradas "CPU+GPU" de NVIDIA, el avance de los CPU ARM de alta densidad de AMD y Ampere, y la tendencia de los principales proveedores de nube (AWS, Google, Microsoft, Alibaba) a desarrollar sus propios CPU ARM personalizados para estos mismos workloads. En conclusión, la redefinición del CPU como el plano de control orquestador en la infraestructura de IA es una tendencia industrial clara. Que Intel, con su Xeon 6+, logre capitalizar esta oportunidad dependerá de su capacidad para competir en un panorama donde la arquitectura, el proceso de fabricación y los ecosistemas están en constante disputa.

marsbit06/03 10:45

La CPU, regresando sigilosamente al centro del escenario de la potencia computacional de IA

marsbit06/03 10:45

Predicción del precio de las acciones de AMD para 2026-2030: ¡Wall Street envía una señal importante con un objetivo de 657 dólares!

**AMD Pronóstico de Precio de Acciones 2026-2030: Objetivo Clave de Wall Street a $657** La acción de AMD ha protagonizado una espectacular recuperación, subiendo más del 130% hasta junio de 2026 y cotizando cerca de $510, impulsada por una transformación fundamental de su negocio: los centros de datos ahora son su motor principal. El primer trimestre de 2026 arrojó ingresos de $10.300 millones, un 38% más, destacando el sector de Data Center con un crecimiento del 57% hasta $5.800 millones, superando por primera vez la mitad de los ingresos totales. El CEO, Lisa Su, revisó al alza el mercado total direccionable (TAM) de CPU para servidores, proyectando más de $1.200 billones anuales para 2030. El consenso de Wall Street, con calificación "Compra Fuerte", ofrece un precio objetivo promedio a 12 meses de $472.17. Sin embargo, objetivos individuales recientes son más alcistas, liderados por los $665 de Barclays. Los modelos de predicción a largo plazo para 2030, anclados en el TAM revisado, sugieren un rango de $493 a $822, con un escenario base alrededor de $657. Los argumentos alcistas se centran en el crecimiento continuo de Data Center, acuerdos clave con OpenAI y Meta, y el próximo lanzamiento de la plataforma MI450. Los riesgos incluyen una elevada relación P/E de más de 169x y la entrada anunciada de Nvidia en el mercado de CPU para servidores, lo que supone una mayor presión competitiva. Cualquier desaceleración podría tener un impacto significativo en la valoración actual.

marsbit06/02 13:17

Predicción del precio de las acciones de AMD para 2026-2030: ¡Wall Street envía una señal importante con un objetivo de 657 dólares!

marsbit06/02 13:17

¿Qué nueva historia alberga la 'fábrica de agentes' de Jensen Huang?

En la conferencia GTC Taipei de NVIDIA durante COMPUTEX 2026, el CEO Jensen Huang presentó una visión centrada en los Agentes de IA como el nuevo núcleo de la infraestructura tecnológica. Se anunció que la plataforma Vera Rubin, diseñada específicamente para cargas de trabajo de Agentes, ya está en producción y ofrece un rendimiento 10 veces mayor que la generación anterior en tareas de Agentes autónomos. Se presentó el procesador Vera, una CPU diseñada para la era de la IA que acelera las tareas de los Agentes. El sistema DSX fue introducido como un "kit de herramientas" integral para el diseño, simulación y operación de "fábricas de IA". Para el entorno empresarial, se lanzó DGX Station for Windows, una estación de trabajo de IA local y segura, junto con el SoC RTX Spark para PC con IA. En el ámbito del software, NVIDIA reveló el modelo Nemotron 3 Ultra de 5500B parámetros y el marco NemoClaw para organizar Agentes de larga duración. Para la IA física, se presentó Cosmos 3, un modelo base multimodal, y en colaboración con Unitree se mostró el robot humanoide H2 Plus, basado en la plataforma Isaac GR00T. Además, se mejoró la seguridad del almacenamiento para Agentes con BlueField-4 STX y se destacó una relación de colaboración bidireccional con TSMC, donde NVIDIA ahora aporta tecnología de IA para optimizar las fábricas de chips. En resumen, NVIDIA está reorganizando su ecosistema completo —desde chips y centros de datos hasta modelos, software y robótica— alrededor del concepto de Agentes de IA, posicionándolos como la unidad fundamental de la próxima era de la computación práctica.

marsbit06/01 12:08

¿Qué nueva historia alberga la 'fábrica de agentes' de Jensen Huang?

marsbit06/01 12:08

Llega el AI PC: ¡Modelos masivos de 120B locales ahora son posibles! NVIDIA redefine la base de la "computadora personal con IA" con RTX Spark

En la conferencia GTC 2026, NVIDIA presentó el chip RTX Spark, redefiniendo el estándar de hardware para los "PCs personales de IA". Integrando una GPU Blackwell, una CPU Grace de 20 núcleos y una arquitectura de memoria unificada de hasta 128GB, el SoC ofrece un rendimiento de 1 petaflop (1000 TOPS) para IA. Esto permite ejecutar localmente modelos de lenguaje de hasta 120B parámetros con ventanas de contexto de hasta un millón de tokens, superando ampliamente las capacidades de los NPU actuales en PCs con IA. Principales fabricantes de equipos originales (OEM) como ASUS, Dell, HP, Lenovo, Microsoft Surface y MSI lanzarán portátiles delgados y equipos de sobremesa compactos con este chip en otoño. NVIDIA y Microsoft colaboran en seguridad, integrando el entorno de ejecución en sandbox OpenShell en Windows para aislar y gestionar de forma segura los agentes de IA locales. Adobe anunció una reestructuración desde el núcleo de Photoshop y Premiere para adaptarse a la arquitectura de memoria unificada, prometiendo mejoras de rendimiento. La llegada de RTX Spark marca un cambio en la industria del PC, donde la GPU se convierte en el componente central del sistema, desafiando el dominio tradicional de las CPU x86. Quedan por ver detalles clave como el precio final, la gestión térmica en portátiles y el rendimiento real en tareas no relacionadas con la IA.

marsbit06/01 06:45

Llega el AI PC: ¡Modelos masivos de 120B locales ahora son posibles! NVIDIA redefine la base de la "computadora personal con IA" con RTX Spark

marsbit06/01 06:45

活动图片