DeepSeek V4 finalmente se lanza, rompiendo el monopolio de los modelos cerrados más potentes y anunciando colaboración con los chips de Huawei

marsbitPublicado a 2026-04-24Actualizado a 2026-04-24

Resumen

DeepSeek-V4 ya está aquí: la nueva generación de modelos de inteligencia artificial de DeepSeek se lanza en versión preliminar y de código abierto. Incluye dos variantes: **DeepSeek-V4-Pro**, con 1,6 billones de parámetros y 49.000 millones de activaciones, diseñado para competir con los mejores modelos cerrados; y **DeepSeek-V4-Flash**, una versión más económica con 284.000 millones de parámetros y 13.000 millones de activaciones, optimizada para velocidad y eficiencia. Ambos soportan un contexto de 1 millón de tokens. Según la evaluación interna, DeepSeek-V4 supera a Claude Sonnet 4.5 en tareas de codificación con agentes y se acerca al rendimiento de Opus 4.6 en modo no reflexivo, aunque aún existe una brecha con el modo reflexivo de Opus. El modelo también destaca en conocimientos generales y razonamiento, situándose a la par de los principales modelos cerrados. La gran novedad es la implementación de un nuevo mecanismo de atención que permite el contexto extenso de manera eficiente, combinando compresión de tokens y atención dispersa (DSA). Además, DeepSeek anuncia que **a partir del segundo semestre de 2026, sus servicios admitirán chips Huawei**, reforzando la independencia tecnológica. La API ya está disponible, compatible con las interfaces de OpenAI y Anthropic, y los modelos antiguos se retirarán en julio de 2026. DeepSeek reafirma su compromiso con el avance en IA de código abierto, priorizando la innovación técnica sobre el ruido mediático.

¡Acaba de llegar DeepSeek-V4!

La versión preliminar ya está disponible y se ha lanzado como código abierto simultáneamente.

Hay dos versiones:

DeepSeek-V4-Pro: comparable con los mejores modelos cerrados, 1.6T, 49B de activación, longitud de contexto de 1M;

DeepSeek-V4-Flash: una versión económica más pequeña y rápida, 284B, 13B de activación, longitud de contexto de 1M.

Las palabras oficiales son: En capacidades de agente, conocimiento del mundo y rendimiento de razonamiento, logra un liderazgo tanto a nivel nacional como en el campo del código abierto.

Y además:

Actualmente, DeepSeek-V4 se ha convertido en el modelo de Agentic Coding utilizado por los empleados internos de la empresa. Según las evaluaciones, la experiencia de uso es superior a Sonnet 4.5, y la calidad de entrega se acerca al modo no reflexivo de Opus 4.6. Sin embargo, aún existe una brecha con el modo reflexivo de Opus 4.6.

Actualmente, tanto el sitio web oficial como la aplicación están actualizados, y el servicio API también se ha actualizado simultáneamente.

En cuanto a la capacidad de computación nacional que a todos preocupa, punto clave: en la segunda mitad del año, se admitirá la capacidad de computación de Huawei.

Opción de gama alta y relación calidad-precio, dos versiones lanzadas juntas

Esta vez, V4 lanza dos versiones de una vez.

V4-Pro, rendimiento comparable con los mejores modelos cerrados.

El juicio oficial se basa en tres puntos:

Capacidad de agente mejorada significativamente: en las evaluaciones de Agentic Coding, V4-Pro ha alcanzado el mejor nivel actual entre los modelos de código abierto, y también ha tenido un rendimiento excelente en otras evaluaciones relacionadas con agentes. En las evaluaciones internas, en el modo Agent Coding, la experiencia de V4 es superior a Sonnet 4.5, y la calidad de entrega se acerca al modo no reflexivo de Opus 4.6, pero aún existe una brecha con el modo reflexivo de Opus 4.6.

Amplio conocimiento del mundo: en las evaluaciones de conocimiento del mundo, DeepSeek-V4-Pro supera significativamente a otros modelos de código abierto, solo ligeramente por detrás del modelo cerrado líder Gemini-Pro-3.1.

Rendimiento de razonamiento de clase mundial: en evaluaciones de matemáticas, STEM y código competitivo, DeepSeek-V4-Pro supera a todos los modelos de código abierto cuyas evaluaciones se han hecho públicas, logrando un excelente rendimiento comparable con los mejores modelos cerrados del mundo.

V4-Flash, una versión económica más pequeña y rápida. Su capacidad de razonamiento se acerca a la Pro, aunque su conocimiento del mundo es un poco inferior, pero tiene menos parámetros y activación, y su API es más económica.

En tareas de agente, DeepSeek-V4-Flash está a la par con DeepSeek-V4-Pro en tareas simples, pero aún hay una brecha en tareas de alta dificultad.

En la prueba de lavado de autos, V4 también la pasó rápidamente.

Y en el clásico escenario biológico del "padre desesperado", DeepSeek-V4 no captó de inmediato el punto clave del daltonismo rojo-verde (según las leyes genéticas, si una mujer es daltónica rojo-verde, su padre biológico necesariamente también lo es).

Contexto de un millón de tokens como estándar

Vale la pena mencionar que, a partir de hoy, un contexto de 1M es estándar en todos los servicios oficiales de DeepSeek.

Hace un año, el contexto de 1M era la carta exclusiva de Gemini; todos los demás modelos cerrados tenían 128K o 200K; en el lado del código abierto, casi nadie podía permitirse jugar a ese nivel.

DeepSeek ha convertido directamente el contexto de un millón de tokens de una "función premium" en "servicios básicos".

Y es de código abierto. ¿Cómo lo lograron? La respuesta está directamente en el comunicado de lanzamiento:

V4 introduce un nuevo mecanismo de atención que comprime en la dimensión de token, combinado con la atención dispersa DSA. En comparación con los métodos tradicionales, reduce significativamente la necesidad de computación y memoria.

DSA no es un término nuevo. Se introdujo por primera vez hace medio año en la actualización V3.2-Exp, que en su momento tuvo poca atención externa porque las puntuaciones eran casi iguales a las de V3.1-Terminus, pareciendo una versión intermedia sin mucho contenido.

Ahora, mirando hacia atrás, esa fue la base de V4.

Optimización específica para capacidades de agente

En el lado del agente, V4 se ha adaptado y optimizado para productos principales de agente como Claude Code, OpenClaw, OpenCode, CodeBuddy, mejorando tanto las tareas de código como las de generación de documentos.

El comunicado de lanzamiento incluye un ejemplo de una página interna de PPT generada por V4-Pro en un framework de agente.

Precios de la API

En el lado de la API, V4-Pro y V4-Flash se lanzan simultáneamente, admitiendo dos interfaces: OpenAI ChatCompletions y Anthropic.

El base_url no cambia, solo modifica el parámetro model a deepseek-v4-pro o deepseek-v4-flash para llamarlo.

Ambas versiones tienen un contexto máximo de 1M y admiten tanto el modo no reflexivo como el modo reflexivo. En el modo reflexivo, puedes ajustar la intensidad con el parámetro reasoning_effort, dos niveles: high y max. La recomendación oficial para escenarios complejos de agente es usar max directamente.

Aquí hay un punto clave: en la segunda mitad del año, se admitirá la capacidad de computación de Huawei.

Además, se eliminarán los nombres de modelos antiguos.

deepseek-chat y deepseek-reasoner se desactivarán en tres meses (24 de julio de 2026). En esta etapa, estos nombres apuntan respectivamente a los modos no reflexivo y reflexivo de V4-Flash.

Para desarrolladores individuales, el impacto es mínimo, solo cambiar un parámetro de modelo. Las empresas con entornos de producción necesitan migrar durante estos tres meses.

One more thing

Al final del comunicado de lanzamiento, DeepSeek cita una frase.

"No seducido por la alabanza, no asustado por la calumnia, procede según el camino, enderézate y corrígete."

Esta es una cita de Xunzi en "Contra los Doce Maestros". Literalmente significa: no dejarse seducir por los elogios, no temer a la difamación, avanzar por el camino que uno cree y corregirse a sí mismo.

En el contexto de hoy, es interesante.

En los últimos seis meses, los rumores sobre cuándo se lanzaría V4, si se había retrasado, si ya había sido superado por otros, si los datos de Claude lo habían destilado, etc., han circulado varias veces en los círculos de IA en chino e inglés. A principios de año, incluso había quien afirmaba con seguridad que V4 se lanzaría antes del Año Nuevo Chino, pero finalmente llegó a finales de abril.

No respondieron ni una vez.

Y luego, en una tarde de viernes, lanzaron V4, simultáneamente en código abierto, actualizaron el sitio web y la App, actualizaron la API, y de paso incluyeron en el comunicado el hecho de que sus empleados internos ya habían dejado de usar Claude.

Sin hoja de ruta, sin transmisión en vivo, sin entrevistas.

Estas cuatro palabras, "proceder según el camino", suenan como un eslogan. Pero si miras la ruta de los últimos seis meses: la versión Exp de V3.2 "sin muchos puntos destacados", la atención dispersa DSA que allanó el camino para V4 durante medio año, el contexto de 1M pasando de ser un as bajo la manga a un estándar.

DeepSeek ya lo ha logrado.

Enlaces de código abierto del modelo DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Informe técnico de DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Este artículo proviene del WeChat público "Quantum Bit", autor: Quantum Bit

Preguntas relacionadas

Q¿Qué dos versiones de DeepSeek-V4 se han lanzado y cuáles son sus características principales?

ASe han lanzado dos versiones: DeepSeek-V4-Pro y DeepSeek-V4-Flash. La V4-Pro tiene 1.6T de parámetros, 49B de activación y una longitud de contexto de 1M, diseñada para competir con los mejores modelos cerrados. La V4-Flash es una versión más económica con 284B de parámetros, 13B de activación y también 1M de contexto, optimizada para velocidad y coste reducido.

Q¿Qué avance significativo introduce DeepSeek-V4 en cuanto a la longitud de contexto y cómo lo logra?

ADeepSeek-V4 establece 1 millón de tokens de contexto como estándar en todos sus servicios, un avance que antes era exclusivo de modelos como Gemini. Lo logra mediante un nuevo mecanismo de atención que comprime a nivel de token, combinado con atención dispersa (DSA), reduciendo significativamente los requisitos de computación y memoria.

Q¿Cómo se compara DeepSeek-V4-Pro con los modelos líderes de Claude según las evaluaciones internas?

ASegún evaluaciones internas, DeepSeek-V4-Pro en modo Agentic Coding tiene una experiencia de uso mejor que Sonnet 4.5 y una calidad de entrega cercana a Opus 4.6 en modo no pensante (non-thinking), aunque aún existe una brecha con el modo pensante (thinking) de Opus 4.6.

Q¿Qué soporte de hardware alternativo anuncia DeepSeek para el futuro?

ADeepSeek anuncia que, a partir del segundo semestre de este año, su modelo tendrá soporte para hardware de Huawei, lo que significa que podrá ejecutarse en chips de esta compañía china.

Q¿Dónde se han publicado los modelos de DeepSeek-V4 para su acceso y uso abierto?

ALos modelos de DeepSeek-V4 se han publicado en código abierto y están disponibles en las plataformas Hugging Face (https://huggingface.co/collections/deepseek-ai/deepseek-v4) y ModelScope (https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4). El informe técnico también está disponible en Hugging Face.

Lecturas Relacionadas

Primer informe financiero tras la gran desvinculación del STRC, ¿cómo restaurará Strategy su rueda de capital?

STRC Superó Su Primera Prueba de Presión: Strategy Informa Pérdidas por BTC, pero Reajusta su Estrategia de Capital El 31 de julio, Strategy, la compañía de tesorería de Bitcoin, publicó sus resultados del segundo trimestre de 2026. A pesar de un aumento del 6.9% en los ingresos totales a $122 millones, la empresa registró una pérdida neta de $8.22 mil millones, impulsada principalmente por $8.32 mil millones en pérdidas no realizadas por la caída del precio de Bitcoin. Su tenencia de BTC creció un 11%, llegando a 843,775 BTC con un costo promedio de $75,000. La atención del mercado se centra en si Strategy puede restaurar su "volante de capital" tras la desvinculación de su principal instrumento de financiación, STRC, que cotiza con un descuento (aproximadamente $89.5). El informe muestra un cambio fundamental: de la compra fija de BTC a una gestión de capital activa y bidireccional. Esta nueva estrategia, el "Marco de Capital de Crédito Digital", conecta sus reservas de BTC, efectivo en USD, acciones ordinarias (MSTR) y valores digitales (STRC). Incluye un programa de monetización, a través del cual ya vendió $218.4 millones en BTC, y planes de recompra de hasta $1 mil millones para STRC (ya recompraron $28.9 millones). La prioridad absoluta es llevar STRC de vuelta a su valor nominal de $100, con el 8 de septiembre como referencia clave. El CEO Phong Le subrayó que la empresa mantendrá el dividendo anual de STRC en el 12%, confiando en el fortalecimiento de su colchón de efectivo ($3.75 mil millones, suficiente para más de 2.1 años de obligaciones) para restaurar la confianza. El futuro de Strategy depende de superar dos pruebas: la reinserción exitosa de STRC a corto plazo y la recuperación del precio de Bitcoin a largo plazo.

marsbitHace 22 min(s)

Primer informe financiero tras la gran desvinculación del STRC, ¿cómo restaurará Strategy su rueda de capital?

marsbitHace 22 min(s)

STRC pierde su ancla: primera presentación de resultados tras la crisis, ¿cómo repara Strategy su volante de capital?

STRC, la principal herramienta de financiación de la empresa tesorera de bitcoin Strategy, sufrió una significativa pérdida de su paridad (anclaje) a partir de mayo, cayendo desde su valor nominal objetivo de 100 dólares a mínimos cercanos a 75 dólares. En este contexto, Strategy publicó su informe financiero del segundo trimestre de 2026. Aunque la compañía reportó una pérdida neta de 8.22 mil millones de dólares, principalmente por pérdidas no realizadas en sus activos digitales debido a la volatilidad del precio de BTC, mantuvo su estrategia central: sus reservas de bitcoin aumentaron un 11% hasta las 843,775 BTC. Sin embargo, el modelo de capital ha cambiado radicalmente. Strategy ha transitado de un ciclo de "financiación y compra" fijo a una gestión de capital activa y bidireccional. Como parte de su nuevo "Marco de Capital de Crédito Digital", ha comenzado a vender BTC (unos 218.4 millones de dólares hasta ahora) para reforzar su liquidez en efectivo, que ya asciende a 3.75 mil millones. El objetivo principal actual es reparar la confianza y devolver el STRC a su paridad. La dirección se ha comprometido a no emitir nuevas acciones preferentes (STRC) con descuento. En su lugar, utilizará su amplia reserva de efectivo para cubrir dividendos y está ejecutando un programa de recompra de hasta 1 mil millones de dólares en valores de crédito digital, priorizando el STRC. La compañía se ha fijado el 8 de septiembre como fecha de referencia para lograr este reanclaje. En resumen, Strategy busca demostrar que es una empresa operativa capaz de gestionar activamente su balance, utilizando sus reservas de BTC, efectivo en dólares, acciones ordinarias (MSTR) y valores de crédito digital (STRC) de forma dinámica para optimizar su estructura financiera. El éxito final de este nuevo modelo depende a corto plazo de la recuperación de la paridad del STRC y, a largo plazo, de un repunte sostenido del precio de Bitcoin.

Odaily星球日报Hace 28 min(s)

STRC pierde su ancla: primera presentación de resultados tras la crisis, ¿cómo repara Strategy su volante de capital?

Odaily星球日报Hace 28 min(s)

AWS representa el 60% de los ingresos totales, Amazon presenta un Q2 sin puntos débiles

Amazon anunció los resultados de su segundo trimestre, con ventas totales de 200,600 millones de dólares. La cifra neta más llamativa fue un beneficio neto de 62,600 millones, impulsado en gran parte por una ganancia no operativa de 53,400 millones procedente de la revalorización de su inversión en Anthropic. Centrándose en el desempeño operativo, el beneficio operativo fue de 27,500 millones. AWS, el negocio de computación en la nube, fue el principal motor, representando el 60.5% de este beneficio operativo. Sus ingresos crecieron un 36.8% interanual, y su beneficio operativo aumentó casi dos tercios. Otras divisiones también mostraron un crecimiento sólido. La publicidad creció un 26.2%, y tanto los servicios para vendedores externos como las tiendas en línea aceleraron su ritmo. Sin embargo, el fuerte flujo de caja operativo generado se ve contrarrestado por importantes inversiones de capital. En los últimos 12 meses, la compra neta de propiedades y equipos (1,690 mil millones) superó al flujo de caja operativo (1,614 mil millones), lo que llevó al flujo de caja libre a territorio negativo. La empresa atribuye este gasto principalmente a inversiones en infraestructura para IA y centros de datos. En resumen, el trimestre mostró un desempeño operativo robusto y sin puntos débiles evidentes, liderado por la aceleración de AWS y el crecimiento de la publicidad y el comercio minorista, mientras la empresa continúa reinvirtiendo agresivamente en su futuro.

marsbitHace 34 min(s)

AWS representa el 60% de los ingresos totales, Amazon presenta un Q2 sin puntos débiles

marsbitHace 34 min(s)

Dos trimestres consecutivos en pérdidas, Coinbase necesita depender de algo más que la negociación

La plataforma estadounidense de intercambio de criptomonedas Coinbase registró una pérdida neta de 359 millones de dólares en el segundo trimestre, el segundo trimestre consecutivo en números rojos. Aunque los ingresos totales cayeron a 1220 millones de dólares, su cuota de mercado en volumen de comercio de criptomonedas alcanzó un récord del 10,3%, según la compañía. El informe muestra que Coinbase está diversificando sus fuentes de ingresos más allá de las comisiones por transacciones al contado, que cayeron a 599 millones de dólares. Los ingresos por suscripciones y servicios, en 555 millones, casi los igualan, destacando los 292 millones provenientes de actividades relacionadas con la stablecoin USDC. Más del 30% de la oferta circulante de USDC se encuentra ahora en los productos de Coinbase. Mientras el volumen de operaciones al contado cayó un 24% hasta 1,46 billones de dólares, el volumen de derivados se mantuvo estable en 10,3 billones, reflejando la demanda continua de instrumentos para cobertura y apalancamiento en un mercado con baja volatilidad. A pesar de la pérdida neta GAAP, el EBITDA ajustado fue positivo en 208 millones de dólares por decimocuarto trimestre consecutivo. La diferencia se debe principalmente a partidas no operativas como cambios en el valor razonable de activos. La compañía también ha reducido gastos, ajustando su guía anual a entre 4200 y 4450 millones. La pregunta clave que deja el informe es si estas nuevas fuentes de ingresos, como las stablecoins y los derivados, pueden sostener a la plataforma de manera más estable a través de los ciclos de mercado, reduciendo su dependencia exclusiva de la actividad transaccional especulativa.

marsbitHace 43 min(s)

Dos trimestres consecutivos en pérdidas, Coinbase necesita depender de algo más que la negociación

marsbitHace 43 min(s)

El trimestre de junio de la empresa tecnológica más valiosa del planeta: los ingresos de Apple superan por primera vez los mil millones de dólares

El 30 de julio, Apple reveló los resultados de su tercer trimestre fiscal de 2026. Los ingresos alcanzaron por primera vez los 109.400 millones de dólares, un récord para un trimestre de junio, impulsados por récords en iPhone, Mac y servicios. El crecimiento fue amplio: todos los segmentos geográficos registraron aumentos de dos dígitos, con Europa y China continental mostrando el mayor dinamismo. iPhone fue el principal motor del crecimiento, representando casi dos tercios del incremento total de ingresos respecto al año anterior. Los servicios y Mac también aportaron un crecimiento significativo, mientras que iPad fue la única categoría en retroceso. Un detalle clave es la contribución de los servicios a la rentabilidad. Aunque representan solo el 28.1% de los ingresos, aportan el 42.4% del margen bruto, gracias a una elevada rentabilidad del 75.6%. Esto significa que los servicios engrosan el beneficio generado por las ventas de hardware. Cabe señalar que los resultados se vieron beneficiados por un reembolso de aranceles, que añadió aproximadamente 2 puntos porcentuales al margen bruto y 0.11 dólares a las ganancias por acción (EPS). Excluyendo este efecto único, el crecimiento de la EPS habría sido de alrededor del 21.7%, todavía superior al crecimiento de los ingresos (16.4%). En resumen, el trimestre muestra una aceleración impulsada por la recuperación del hardware, especialmente el iPhone, mientras que el sólido negocio de servicios continúa mejorando la rentabilidad general. Un reembolso único contribuyó a incrementar la tasa de crecimiento de los beneficios.

marsbitHace 43 min(s)

El trimestre de junio de la empresa tecnológica más valiosa del planeta: los ingresos de Apple superan por primera vez los mil millones de dólares

marsbitHace 43 min(s)

Trading

Spot
活动图片