Xiaomi y MiniMax lanzan simultáneamente grandes novedades: la guerra de precios de Agent comienza oficialmente

marsbitPublicado a 2026-03-20Actualizado a 2026-03-20

Resumen

El 18 y 19 de marzo, las empresas chinas MiniMax y Xiaomi lanzaron sus modelos de IA para Agent: M2.7 y MiMo-V2-Pro, respectivamente. Ambos entraron en el primer nivel global de rendimiento en benchmarks de Agent, pero con precios muy inferiores. M2.7 cuesta 1,2 dólares por millón de tokens, y V2-Pro, 3 dólares, frente a los 25 de Claude Opus 4.6. Xiaomi opta por un modelo masivo: V2-Pro tiene más de 1 billón de parámetros y una ventana de contexto de 1 millón de tokens, destacando en ingeniería de código. MiniMax elige una ruta distinta: M2.7 utiliza un mecanismo de autoevolución que mejora iterativamente su propio rendimiento, sobresaliendo en automatización de oficina. El ritmo de desarrollo también difiere: MiniMax lanza versiones cada 49 días en promedio, mientras que Xiaomi hace actualizaciones más espaciadas pero con saltos mayores en capacidad. Además, Xiaomi usó una estrategia de lanzamiento anónimo en OpenRouter durante 8 días, donde su modelo, bajo el nombre 'Hunter Alpha', lideró la plataforma antes de ser revelado.

Los días 18 y 19 de marzo, dos empresas chinas lanzaron sucesivamente sus grandes modelos de inteligencia artificial en la dirección Agent. La startup china de IA MiniMax presentó el M2.7, mientras que el equipo de modelos de lenguaje de Xiaomi, MiMo, lanzó el V2-Pro. Ambos modelos se situaron en la primera línea global en el benchmark de Agent, pero sus precios de salida de API son 1/21 y 1/8 del Claude Opus 4.6, respectivamente.

Ambas empresas jugaron sus cartas la misma semana, pero con manos completamente diferentes. Representan dos rutas tecnológicas截然 distintas, apostando por dos futuros diferentes en la era Agent.

El mismo examen, 1/17 de la matrícula

Primero, veamos la comparación más直观.

Según los datos de OpenRouter y las páginas de precios oficiales de las empresas, en términos de precio de salida de API (por millón de tokens), el MiniMax M2.7 es de 1.2 dólares, y el MiMo-V2-Pro es de 3 dólares. Como referencia, el precio de salida de Claude Opus 4.6 es de 25 dólares, GPT-5.2 es de 14 dólares, y Claude Sonnet 4.6 es de 15 dólares.

La brecha de precios es de órdenes de magnitud, pero la brecha de capacidad no lo es. En SWE-bench Verified (el benchmark más popular actualmente para medir la capacidad de ingeniería de código), el MiMo-V2-Pro obtuvo un 78%, y Sonnet 4.6 un 79.6%, con una diferencia de menos de dos puntos porcentuales. El resultado de M2.7 en SWE-Pro fue del 56.22%, igualándose con GPT-5.3-Codex. En VIBE-Pro (capacidad de entrega de proyectos de extremo a extremo), M2.7 obtuvo un 55.6%, acercándose al nivel de Opus 4.6.

El punto clave de esta imagen no está en quién es más alto o más bajo—los sistemas de benchmark de cada empresa no están completamente alineados, por lo que hay que ser cauteloso al comparar directamente. El punto clave está en esa "tijera de precio-rendimiento": los modelos Agent chinos ya se han colado en la misma banda de capacidad, pero se sitúan en rangos de precios completamente diferentes.

Billones de parámetros vs. Auto-evolución

El precio es solo la apariencia. Las dos empresas han mostrado dos cartas completamente diferentes.

El MiMo-V2-Pro sigue la ruta de "fuerza bruta para lograr milagros". Según el anuncio oficial de Xiaomi, el V2-Pro tiene más de 1 billón de parámetros totales, con 42B de parámetros activados, y admite un contexto ultra-largo de 1 millón de tokens. Su innovación central es el mecanismo de atención híbrida Hybrid Attention, que ajusta la proporción entre la atención de ventana deslizante (SWA) y la atención global (GA) a 7:1—la generación anterior V2-Flash era 5:1. Esta arquitectura hace que el modelo sea más estable al manejar documentos largos y escenarios Agent con llamadas paralelas a múltiples herramientas. En PinchBench (evaluación de la capacidad de llamada a herramientas Agent), el MiMo-V2-Pro obtuvo un 84%.

El M2.7 siguió un camino completamente diferente. Según el blog técnico oficial publicado por MiniMax el 18 de marzo, la cantidad de parámetros de M2.7 no se ha hecho pública, pero mostró un mecanismo de "evolución auto-iterativa": el modelo ejecuta autónomamente más de 100 ciclos de optimización, incluyendo análisis de trayectorias de fallo, planificación de modificaciones, modificación de su propia arquitectura de código, ejecución de evaluaciones y repetición del ciclo, logrando finalmente una mejora del 30% en el rendimiento en el conjunto de evaluación interno. En las 22 preguntas de alta dificultad de MLE Bench Lite (evaluación de dificultad en competiciones de aprendizaje automático), M2.7 consiguió 9 oros, 5 platas y 1 bronce, con una tasa media de medallas del 66.6%.

Desde cinco dimensiones, los enfoques de las dos rutas son completamente diferentes: el MiMo-V2-Pro es claramente superior en longitud de contexto e ingeniería de código, mientras que el M2.7 marca la diferencia en automatización de oficina y capacidad de auto-iteración. Según el mismo blog técnico de MiniMax, el M2.7 obtuvo una puntuación ELO de 1495 en GDPval-AA (evaluación de procesamiento de documentos de oficina), ocupando el primer lugar entre los modelos de código abierto, y mantuvo una tasa de seguimiento de habilidades del 97% en la prueba MM-Claw, que cubre más de 40 habilidades complejas.

Cuatro versiones en cinco meses

Las dos empresas no solo tienen rutas tecnológicas diferentes, sino también ritmos de iteración completamente distintos.

Según los registros de lanzamiento públicos, desde el lanzamiento de M2 en octubre de 2025 hasta el lanzamiento de M2.7 en marzo de 2026, MiniMax iteró cuatro versiones en cinco meses, con una media de una versión principal cada 49 días. El intervalo entre M2.5 y M2.7 fue de solo unos 30 días.

El ritmo de Xiaomi MiMo es diferente: lanzó MiMo-7B (modelo de inferencia de código abierto con 7B de parámetros) en abril de 2025, V2-Flash (309B de parámetros totales) en diciembre del mismo año, y V2-Pro (1T de parámetros totales) en marzo de 2026. Cada generación implica un salto mayor en la escala de parámetros, pero los intervalos entre versiones también son más largos.

MiniMax optó por pasos pequeños y rápidos, con iteraciones de amplitud pero frecuencia extremadamente alta, y el mecanismo de auto-iteración de M2.7 está diseñado precisamente para la "evolución continua". Xiaomi optó por un golpe concentrado, donde cada versión supone un gran salto en la escala de parámetros y la arquitectura.

8 días anónimos, llegando a la cima de OpenRouter

Además de la ruta tecnológica, la estrategia de lanzamiento de Xiaomi también rompió con las convenciones de la industria.

Según Reuters, el 11 de marzo, un modelo anónimo llamado Hunter Alpha apareció en OpenRouter, la mayor plataforma de agregación de API del mundo. Sin respaldo de marca, sin conferencia de prensa, sin blog técnico. Su precio de API era extremadamente bajo, pero su rendimiento era sorprendentemente fuerte.

La comunidad comenzó a especular sobre su origen. Según Republic World y varios medios de tecnología, la猜测 principal era DeepSeek V4, porque la responsable del equipo MiMo, Luo Fuli, había trabajado previamente en investigación en DeepSeek. El volumen de llamadas aumentó rápidamente, superando 1 billón de tokens durante el período anónimo, y llegó al primer lugar en el ranking semanal de OpenRouter.

En la madrugada del 19 de marzo, Xiaomi reveló la incógnita: Hunter Alpha era el MiMo-V2-Pro. Según el mismo informe de Reuters, las acciones de Xiaomi en Hong Kong experimentaron una subida de hasta el 5.8% tras la revelación.

Esta es la primera vez que un gran modelo chino se prueba a sí mismo a nivel mundial de forma completamente ciega. Sin depender de la marca, sin publicidad, usando 8 días para que los desarrolladores voten con los pies.

Criptos en tendencia

Preguntas relacionadas

Q¿Qué dos empresas chinas lanzaron sus modelos de IA en agentes el 18 y 19 de marzo, y qué modelos presentaron?

AMiniMax lanzó el modelo M2.7 y Xiaomi (a través de su equipo MiMo) presentó el modelo V2-Pro.

Q¿Cuál es la diferencia de precio en la API de salida entre MiniMax M2.7 y Claude Opus 4.6, según los datos proporcionados?

AEl precio de la API de salida de MiniMax M2.7 es 1.2 dólares por millón de tokens, mientras que el de Claude Opus 4.6 es de 25 dólares, por lo que MiniMax es aproximadamente 1/21 del precio de Claude Opus.

Q¿En qué se diferencian las rutas técnicas de MiMo-V2-Pro y MiniMax M2.7 según el artículo?

AMiMo-V2-Pro sigue una ruta de 'fuerza bruta' con más de 1 billón de parámetros y una atención híbrida, mientras que MiniMax M2.7 utiliza un mecanismo de 'evolución autoiterativa' que mejora autónomamente su rendimiento mediante múltiples optimizaciones.

Q¿Qué estrategia de lanzamiento inusual utilizó Xiaomi para MiMo-V2-Pro antes de revelar su autoría?

AXiaomi lanzó inicialmente el modelo de forma anónima bajo el nombre 'Hunter Alpha' en OpenRouter durante 8 días, donde alcanzó el primer lugar en uso antes de revelar que era MiMo-V2-Pro.

Q¿Cómo se compara el rendimiento de MiMo-V2-Pro y Claude Sonnet 4.6 en SWE-bench Verified?

AMiMo-V2-Pro obtuvo un 78% en SWE-bench Verified, mientras que Claude Sonnet 4.6 alcanzó un 79.6%, una diferencia de menos de dos puntos porcentuales.

Lecturas Relacionadas

¿El violento rebote de los chips de memoria es el regreso del toro o un rebote de gato muerto?

La noche pasada, las acciones tecnológicas y de chips de memoria experimentaron un repunte extremo en Wall Street. SK Hynix subió un 17,52%, Micron un 18,36% y Microsoft un histórico 15,51%. Esta "rebote violento" fue impulsado por varios factores simultáneos. Primero, las autoridades surcoreanas, bajo presión política tras las fuertes pérdidas de inversores minoristas, evaluan medidas de rescate como una posible prohibición temporal de ventas en corto, señalando un "soporte político" para el mercado. Segundo, el proceso de desapalancamiento en Corea, clave para la estabilización, parece estar en su fase final. Los activos de los ETF apalancados se han reducido en casi un 70%, lo que sugiere que la presión de ventas forzadas más intensa podría haber pasado. Tercero, desde EE.UU., llegaron dos impulsos cruciales: datos de inflación (PCE básico) más fríos que relajaron las expectativas de tasas, y unos resultados extraordinarios de Microsoft. El fuerte crecimiento de su servicio en la nube, Azure (ingresos anuales superiores a 100.000 millones de dólares), desmintió la narrativa de que el gasto en capital de la IA se estaba desacelerando, provocando un rebote por pánico de los vendedores en corto. Sin embargo, persisten riesgos importantes. Las expectativas de nuevas subidas de tipos del Banco de Japón podrían aumentar el coste de las operaciones de carry trade (arbitraje de divisas) y limitar el alcance del rebote. Además, la sostenibilidad de los altos márgenes del sector de la memoria, ante el ciclo de oferta y la entrada de actores como CXMT de China, aún está por verificarse. En conclusión, mientras que han aparecido un suelo político, una reducción del apalancamiento y una reconfirmación de la demanda de IA, es pronto para declarar el regreso de un mercado alcista. Los inversores deben evitar decisiones impulsivas y centrarse en la disciplina, esperando señales de confirmación sobre los precios de la memoria (HBM, DRAM) y eventos clave como los resultados de Nvidia.

marsbitHace 8 min(s)

¿El violento rebote de los chips de memoria es el regreso del toro o un rebote de gato muerto?

marsbitHace 8 min(s)

¿Bloqueará el ‘terrorista’ Dúrov a los funcionarios rusos?

Pavel Durov ha respondido públicamente a la decisión de las autoridades rusas de incluirlo en la lista de terroristas y extremistas. Según el fundador de Telegram, esta medida se debe a su negativa a cumplir con las exigencias de vigilancia masiva y censura en la aplicación. Durov señaló la ironía de que se le prohíba "publicar información en internet" siendo el creador de una de las mayores plataformas de mensajería. Su declaración concluyó con una frase que se ha viralizado: los funcionarios rusos "claramente no entienden quién puede bloquear a quién en internet". Esta afirmación sugiere una posible escalada. Técnicamente, la administración de Telegram tiene control sobre qué canales existen en su plataforma, incluidos los verificados de ministerios y funcionarios rusos que, a pesar del bloqueo oficial en el país, siguen usándolo para comunicarse oficialmente. La retórica de Durov indica la posibilidad de que imponga restricciones a estas cuentas estatales. El contexto muestra una contradicción. Mientras el gobierno obliga a los funcionarios a migrar al mensajero ruso 'MAX' para 2030 y bloquea alternativas como BiP o KakaoTalk para los ciudadanos, muchos servidores públicos continúan usando Telegram de forma paralela, a menudo con dispositivos y SIM separados, desconfiando de la plataforma estatal. La situación recuerda al conflicto de 2020, cuando Rusia levantó el bloqueo a Telegram, pero ahora el poder de acción está del lado de Durov. Su declaración es la primera reacción al estatus de "terrorista", y si sus palabras se traducirán en acciones reales contra los canales oficiales dependerá de la evolución de los próximos acontecimientos.

cryptonews.ruHace 19 min(s)

¿Bloqueará el ‘terrorista’ Dúrov a los funcionarios rusos?

cryptonews.ruHace 19 min(s)

DeepSeek V4 versión oficial está aquí, nuevas capacidades emergen, comienza la batalla por el rey de la relación calidad-precio

El 31 de julio, DeepSeek lanzó la versión oficial de su API DeepSeek-V4-Flash para prueba pública. La actualización muestra una mejora significativa en las capacidades de agente, acercándose o incluso superando el rendimiento de la versión preliminar V4-Pro de hace tres meses en varias pruebas de referencia, a pesar de tener un modelo mucho más ligero (284 mil millones de parámetros totales, 13 mil millones activos). Los registros oficiales indican que V4-Flash obtuvo 82.7 puntos en Terminal Bench 2.1, 54.2 en NL2Repo, 76.7 en Cybergym y 70.3 en Toolathlon verified. DeepSeek aclaró que la estructura y el tamaño del modelo son los mismos que en la versión preliminar, y que las mejoras se lograron únicamente mediante un nuevo "post-entrenamiento", destacando la importancia de los métodos y la calidad de los datos frente al mero tamaño del modelo. La actualización subraya el enfoque estratégico de DeepSeek en las capacidades de agente (planificación autónoma, uso de herramientas) como nuevo campo de batalla clave para 2026. Al impulsar el rendimiento de su modelo más liviano y económico, la empresa busca posicionarse como una opción de alta relación costo-eficacia para desarrolladores y aplicaciones de agente, desafiando directamente a gigantes como OpenAI. Esta movida sigue a una ronda de financiación récord de más de 50 mil millones de RMB, lo que refleja la apuesta del mercado por su tecnología y su potencial comercial en una competencia que está redefiniendo la importancia de la eficiencia frente a la escala pura.

marsbitHace 22 min(s)

DeepSeek V4 versión oficial está aquí, nuevas capacidades emergen, comienza la batalla por el rey de la relación calidad-precio

marsbitHace 22 min(s)

ChatGPT emite una prohibición repentina, dejando sin sustento de la noche a la mañana a los redactores de IA de todo el mundo

La era dorada de la escritura con IA está colapsando. Aunque los modelos se vuelven más potentes, la calidad de los textos generados parece deteriorarse, resultando en contenido técnicamente correcto pero sin sustancia memorable. Investigadores como Adam Hunt señalan que, mientras habilidades como la codificación mejoran gracias a datos de entrenamiento claros y retroalimentación automática (como códigos que funcionan), la expresión lingüística se estanca. Esto se debe a la falta de métricas objetivas para evaluar la calidad literaria, lo que lleva a que los modelos no se optimicen para ello. Paralelamente, plataformas como ChatGPT están restringiendo funciones clave. Ahora rechazan explícitamente imitar el estilo de escritores famosos (como Stephen King o J.K. Rowling) cuando se les pide directamente, una herramienta que antes usaban muchos creadores. Aunque aún aceptan solicitudes basadas en características abstractas (ritmo, suspenso), el resultado pierde la esencia del autor imitado. Estos cambios están erosionando la confianza de los usuarios. La escritura con IA no desaparecerá, pero se está redefiniendo como una herramienta de apoyo —útil para investigación, estructuración o edición—, no como un reemplazo del juicio, la experiencia y la voz creativa humana, que recuperan su valor central en el proceso creativo.

marsbitHace 23 min(s)

ChatGPT emite una prohibición repentina, dejando sin sustento de la noche a la mañana a los redactores de IA de todo el mundo

marsbitHace 23 min(s)

Trading

Spot

Artículos destacados

Cómo comprar WAR

¡Bienvenido a HTX.com! Hemos hecho que comprar WAR (WAR) sea simple y conveniente. Sigue nuestra guía paso a paso para iniciar tu viaje de criptos.Paso 1: crea tu cuenta HTXUtiliza tu correo electrónico o número de teléfono para registrarte y obtener una cuenta gratuita en HTX. Experimenta un proceso de registro sin complicaciones y desbloquea todas las funciones.Obtener mi cuentaPaso 2: ve a Comprar cripto y elige tu método de pagoTarjeta de crédito/débito: usa tu Visa o Mastercard para comprar WAR (WAR) al instante.Saldo: utiliza fondos del saldo de tu cuenta HTX para tradear sin problemas.Terceros: hemos agregado métodos de pago populares como Google Pay y Apple Pay para mejorar la comodidad.P2P: tradear directamente con otros usuarios en HTX.Over-the-Counter (OTC): ofrecemos servicios personalizados y tipos de cambio competitivos para los traders.Paso 3: guarda tu WAR (WAR)Después de comprar tu WAR (WAR), guárdalo en tu cuenta HTX. Alternativamente, puedes enviarlo a otro lugar mediante transferencia blockchain o utilizarlo para tradear otras criptomonedas.Paso 4: tradear WAR (WAR)Tradear fácilmente con WAR (WAR) en HTX's mercado spot. Simplemente accede a tu cuenta, selecciona tu par de trading, ejecuta tus trades y monitorea en tiempo real. Ofrecemos una experiencia fácil de usar tanto para principiantes como para traders experimentados.

782 Vistas totalesPublicado en 2024.12.11Actualizado en 2026.06.02

Cómo comprar WAR

Discusiones

Bienvenido a la comunidad de HTX. Aquí puedes mantenerte informado sobre los últimos desarrollos de la plataforma y acceder a análisis profesionales del mercado. A continuación se presentan las opiniones de los usuarios sobre el precio de WAR (WAR).

活动图片