Anthropic filtra nuevos modelos 'comiendo sandía', el poderoso Fable 5 fracasa en frío

marsbitPublicado a 2026-08-24Actualizado a 2026-08-24

Resumen

Anthropic ha sacado a la luz dos nuevos modelos, 'claude-marshmallow-eap' y 'claude-melon-eap', a través de aplicaciones de terceros. Las primeras pruebas sugieren que Marshmallow supera en fluidez conversacional a Opus 5. Se especula que serían una mejora de los niveles Opus y Sonnet, respectivamente, con lanzamiento previsto para la próxima semana. Este movimiento ocurre mientras el modelo más potente y caro de Anthropic, Fable 5, lanzado hace dos meses, enfrenta una fría acogida en el mercado empresarial. Datos de Ramp muestran que solo capta alrededor del 11% del gasto en tokens de las empresas que usan Anthropic, muy por detrás del 25% de su competidor directo, GPT-5.6 Sol de OpenAI. Además, el lanzamiento de Opus 5 en julio complicó la posición de Fable 5. Con la mitad de precio, Opus 5 logra un rendimiento muy similar en pruebas de programación, lo que ha llevado a las empresas a preferirlo. Al mismo tiempo, los modelos de código abierto están ganando terreno rápidamente, pasando del 11% al 62% en cuota de tokens usados entre abril y agosto, mientras su costo sigue siendo marginal. En este contexto, los nuevos modelos Marshmallow y Melon parecen ser la respuesta de Anthropic para ofrecer opciones más equilibradas entre capacidad y costo, buscando productos que las empresas estén dispuestas a adoptar y usar a gran escala de forma sostenida.

¡Anthropic ha revelado de antemano dos nuevas 'cartas'!

Hoy, en aplicaciones de desarrolladores de terceros y en la comunidad de Discord, aparecieron dos ID de modelo desconocidos:

  • claude-mashmallow-eap (Malvavisco)
  • claude-melon-eap (Melón)

Han surgido pruebas tempranas: Marshmallow muestra un rendimiento superior, con una naturalidad conversacional que supera a Opus 5, mientras que Melon es ligeramente inferior.

Sin embargo, sus capacidades generales no están al nivel de "Fable". Se lanzarán la semana que viene como muy pronto.

Mientras todo el mundo en internet seguía el chisme, Anthropic internamente 'explotó' una bomba:

Fable 5 lleva más de dos meses en línea, pero se enfrenta a un casi abandono colectivo.

Anthropic juega cartas de emergencia

Se filtra un nuevo modelo de Claude

Esta ronda de actualizaciones parece llegar con más urgencia que antes.

Los expertos del sector de la IA especulan que Marshmallow probablemente corresponde a una iteración de nivel Opus, quizás Opus 5.1.

Mientras que Melón se acerca más al nivel Sonnet.

Los resultados de una prueba SVG compartida por un usuario también ampliaron la brecha entre los dos modelos.

Anthropic aún no ha respondido oficialmente, pero las pistas comienzan a acumularse.

Si se tratara solo de una actualización normal, esto no sería extraño.

Lo realmente sutil es: ¿por qué precisamente ahora?

Después de todo, hace apenas dos meses, Anthropic acaba de poner sobre la mesa su carta más fuerte y cara.

Era Fable 5, la cima de la pirámide de Claude.

El poderoso Fable 5, sorprendentemente fracasa

Hace dos meses, Fable 5 hizo su debut con la aureola de 'buque insignia más fuerte' de Anthropic.

El más capaz, el más caro, y además la IA más avanzada de toda la línea de productos Claude.

Siguiendo la inercia de la industria, cuando se lanza un nuevo buque insignia, las grandes empresas suelen migrar rápidamente, inclinando el presupuesto hacia el modelo más nuevo y potente.

¡Esta vez, la regla falló con Fable 5!

La plataforma de pagos Ramp rastreó los datos de consumo de tokens de más de 70,000 empresas en EE. UU. y descubrió:

Un mes después del lanzamiento de Fable 5, solo había capturado el 6% de las llamadas de tokens de las empresas en Anthropic, con una cuota de gasto del 11.4%.

Ahora, después de más de dos meses, los últimos datos obtenidos por el FT muestran que esta cuota de gasto sigue rondando el 11%.

Es decir, son muy pocos los desarrolladores y grandes empresas realmente dispuestos a cambiar sus modelos a Fable 5.

Por el contrario, el buque insignia de OpenAI, GPT-5.6 Sol, se llevó durante el mismo período el 25% de los tokens y el 23% de la cuota de gasto.

En el mismo campo de juego, la cuota del modelo tope de gama de Anthropic es solo una cuarta parte que la de su competidor.

Lo más incómodo es que la contribución total de ingresos de Fable 5 es aproximadamente solo el 75% de la de GPT-5.6 Sol, aunque cuesta el doble por token.

¿Cuán caro es?

El precio unitario de Fable 5 es el doble que el del Opus 4.8 de Anthropic y 10 veces más caro que Haiku 4.5.

Aunque es poderoso, la mayoría de los escenarios diarios de las empresas ni siquiera requieren ese nivel.

El Opus 5 de la casa, contraataca al hermano mayor

Otro modelo de Anthropic es el 'golpe frontal' para Fable 5.

A finales de julio, Opus 5 hizo su aparición oficial, con un precio que es solo la mitad del de Fable 5, pero en evaluaciones de programación y trabajo de conocimiento, obtuvo mejores resultados.

Los resultados de la prueba CursorBench 3.2 son aún más directos:

Opus 5 obtuvo un 70% con el máximo poder de cómputo, coste por tarea $8.23. Fable 5 obtuvo un 70.5%, 0.5 puntos porcentuales más, pero costando $17.32.

Equivale a gastar el doble de dinero por solo un 0.5% más de rendimiento.

El resultado del voto con los pies de las empresas no es sorprendente: los datos de Ramp muestran que después del lanzamiento de Opus 5, su gasto rápidamente superó al de Fable 5.

Pero el problema es: si el modelo buque insignia es solo una 'vitrina', ¿por qué el mercado le da una valoración de 2 billones de dólares?

El código abierto pasó del 11% al 62% en solo cuatro meses

Además, la expansión frenética de la IA de código abierto también ejerce presión sobre Anthropic.

Según las estadísticas de Vercel AI Gateway:

En abril, la cuota de tokens de los modelos de código abierto era solo del 11%. Para junio, esta cifra se disparó al 29%. Los últimos datos de agosto alcanzaron directamente el 62%.

En solo dos meses, pasó de menos de un tercio a más del 60%. Y el dinero que gastan es menos del 4% del gasto total de las empresas.

En otras palabras, los modelos que hacen la mayor parte del trabajo casi no cuestan nada.

Esto hace que la posición de Fable 5 sea cada vez más incómoda.

Mirando hacia dentro, Opus 5, a la mitad del precio, ya está pisándole los talones; mirando hacia fuera, los modelos de código abierto siguen reduciendo los precios una y otra vez.

Por supuesto, Fable 5 puede seguir encargándose de empujar los límites de capacidad.

Pero lo que Anthropic necesita más ahora son modelos que las empresas estén realmente dispuestas a usar a largo plazo y a gran escala.

Visto así, la repentina aparición de Marshmallow (Malvavisco) y Melon (Melón) ya no es tan sorprendente.

Lo que pueden estar llenando es probablemente la pieza más crucial del 'combo familiar' de Claude:

Suficientemente fuerte, pero también suficientemente barato; capaz de mostrar músculo, pero sobre todo, que alguien esté dispuesto a pagar por ello.

Referencias:

https://x.com/kimmonismus/status/2091599817084412221?s=20

https://www.ft.com/content/5ee49718-c258-4f01-aa32-7e5b76ae5245?syn-25a6b1a6=1

Este artículo proviene de la cuenta oficial de WeChat "新智元" (New Zhiyuan), autor: ASI启示录, editor: 桃子

Preguntas relacionadas

Q¿Qué dos nuevos modelos de Anthropic fueron filtrados en comunidades de desarrolladores y Discord?

ALos dos nuevos modelos filtrados fueron 'claude-marshmallow-eap' (Algodón de Azúcar) y 'claude-melon-eap' (Melón).

QSegún el artículo, ¿cuál fue el rendimiento de los modelos 'Marshmallow' y 'Melon' en las pruebas iniciales?

AEn las pruebas iniciales filtradas, 'Marshmallow' mostró un rendimiento más fuerte y una naturalidad en el diálogo que superaba a Opus 5, mientras que 'Melon' fue ligeramente inferior.

Q¿Qué problema enfrentó el modelo insignia 'Fable 5' de Anthropic después de su lanzamiento, según los datos de la plataforma de pagos Ramp?

ASegún los datos de Ramp, que rastrea el consumo de tokens de más de 70,000 empresas estadounidenses, el 'Fable 5' solo capturó alrededor del 6% del volumen de llamadas de tokens y el 11.4% del gasto en Anthropic un mes después de su lanzamiento, cifras que se mantuvieron bajas después de dos meses, indicando una adopción limitada por parte de desarrolladores y grandes empresas.

Q¿Cómo se compararon los modelos 'Opus 5' y 'Fable 5' en términos de rendimiento y costo en la prueba CursorBench 3.2 mencionada en el artículo?

AEn la prueba CursorBench 3.2, Opus 5 obtuvo una puntuación del 70% con un costo por tarea de $8.23, mientras que Fable 5 obtuvo un 70.5% (solo 0.5 puntos porcentuales más) pero con un costo de $17.32, el doble de caro por una mejora marginal.

Q¿Qué tendencia muestra la adopción de modelos de IA de código abierto según las estadísticas de Vercel AI Gateway citadas en el artículo?

ALas estadísticas de Vercel AI Gateway muestran que la cuota de tokens de los modelos de código abierto aumentó drásticamente del 11% en abril al 29% en junio, y luego al 62% en agosto, mientras que su costo representaba menos del 4% del gasto total de las empresas, indicando una adopción masiva y rentable.

Lecturas Relacionadas

La mayor cuestión político-económica de la era de la IA: si los robots son cada vez más capaces, ¿cómo comparte la humanidad el valor?

El título del artículo plantea la pregunta crucial de la era de la IA: ¿cómo compartirán los humanos el valor creado por máquinas cada vez más capaces? El artículo critica un análisis de *The Economist* sobre China, que sugiere que su enfoque en la tecnología podría distorsionar la asignación de recursos y no abordar la débil demanda interna. Sin embargo, el autor argumenta que el problema central es más profundo y global: la IA está reescribiendo la lógica fundamental de la creación y distribución de la riqueza. A diferencia de revoluciones industriales anteriores, donde los humanos seguían siendo el núcleo del proceso productivo, la IA (especialmente en forma de AGI) amenaza con reemplazar masivamente el trabajo cognitivo. Esto plantea un desafío existencial: la economía podría seguir creciendo, pero con menos personas participando directamente en la creación de valor. El mayor problema no es solo el desempleo, sino la distribución: si el poder adquisitivo de los consumidores no crece, surgirá una contradicción de "demanda insuficiente". Aunque China necesita desesperadamente impulsar sectores como la IA y la robótica como nuevos motores de crecimiento, el verdadero reto es cerrar la brecha entre la innovación tecnológica, los beneficios empresariales, los ingresos de los hogares y el consumo. Este "punto de ruptura" en la transmisión de los beneficios de la productividad es un fenómeno global, como lo demuestra la concentración de riqueza en las grandes tecnológicas estadounidenses frente al estancamiento de los ingresos laborales. El artículo esboza tres posibles caminos futuros: el capitalismo tradicional (los beneficios van a los accionistas), el capitalismo de estado (participación del gobierno) o modelos más innovadores como fondos soberanos digitales, propiedad accionarial ciudadana o rentas básicas universales adaptadas a la era de la IA. Para China, la oportunidad estratégica reside en utilizar su capacidad de coordinación política para no solo convertirse en una potencia de IA, sino también en construir un sistema que permita a la mayoría compartir sus beneficios. Esto requerirá reformas en la distribución del ingreso, el sistema de seguridad social y la formación profesional. La competencia futura no se tratará solo de quién tiene la mejor tecnología, sino de quién construye el mejor sistema de distribución para la era de la inteligencia artificial. Resolver cómo los humanos obtienen ingresos y comparten el valor cuando las máquinas realizan gran parte del trabajo es el principal problema de economía política de nuestro tiempo.

marsbitHace 4 min(s)

La mayor cuestión político-económica de la era de la IA: si los robots son cada vez más capaces, ¿cómo comparte la humanidad el valor?

marsbitHace 4 min(s)

Anthropic se retracta y se disculpa, Claude 'reducido en inteligencia' de forma encubierta confirmado

El desarrollador argofowl descubrió que Claude Code, desde la versión 2.1.237, estaba interpretando el nivel de razonamiento "high" como un valor de 10/100, equivalente al antiguo nivel "low". Esto formaba parte de una prueba A/B de "escala de esfuerzo comprimida" realizada por Anthropic sin notificación, lo que causó frustración entre los desarrolladores que dedicaron tiempo a depurar su código sin saberlo. El ingeniero Thariq Shihipar respondió que el experimento solo cambia el mapeo numérico y no afecta el rendimiento, según sus evaluaciones. Sin embargo, surgieron quejas más amplias sobre Claude Opus 5, siendo acusado de volverse más vago, propenso a errores y de rendimiento inconsistente. Thariq reconoció que Opus 5 es un modelo "notablemente inestable" y que solucionarlo es de máxima prioridad. El incidente destaca una desconexión sistémica en la industria de la IA: mientras los puntajes de referencia (benchmarks) siguen mejorando, la experiencia subjetiva de los usuarios a menudo se deteriora. Las actualizaciones de modelos se realizan de manera opaca, con pruebas A/B, cambios de cuantización y ajustes en el servidor sin la transparencia de las actualizaciones de software tradicionales, dejando a los usuarios confiar únicamente en su percepción. La estabilidad del modelo es fundamental para generar confianza cuando se convierte en infraestructura básica.

marsbitHace 30 min(s)

Anthropic se retracta y se disculpa, Claude 'reducido en inteligencia' de forma encubierta confirmado

marsbitHace 30 min(s)

Develando el verdadero panorama de apalancamiento, liquidez y riesgos detrás de la tokenización de activos

El artículo analiza la realidad de los activos del mundo real tokenizados (RWA) en el ecosistema DeFi, argumentando que la mera tokenización, como un código de barras, es insuficiente. La verdadera transformación proviene de la creación de un sistema financiero completo: liquidez efectiva en condiciones adversas, mecanismos de préstamo y apalancamiento, y un sólido proceso de liquidación de riesgos. El autor destaca cuatro principales desafíos: 1) La discordancia de tiempo entre los mercados blockchain (24/7) y los tradicionales, lo que genera un vacío de liquidez y riesgos durante eventos de liquidación. 2) La necesidad de redefinir la liquidez no como TVL, sino como la capacidad de salida en ventanas de tiempo realistas bajo presión. 3) La paradoja de que el apalancamiento, aunque crucial para la utilidad, introduce fragilidad si los modelos de riesgo (por ejemplo, ratios de colateralización) no consideran factores estructurales más allá de la volatilidad del precio. 4) La naturaleza interconectada del riesgo, que debe modelarse como una red de dependencias entre custodia, oráculos, mecanismos de reembolso y protocolos DeFi. Más allá de los bonos del tesoro, que son un primer paso, se exploran casos complejos como la energía y la capacidad de cómputo (GPU). Finalmente, se propone que la verdadera integración ocurre cuando un token RWA puede soportar una crisis, integrado en un sistema de mercado resiliente con herramientas como contratos perpetuos complementarios. La visión final no es "tokenizarlo todo", sino crear un sistema donde los activos productivos sean accesibles y gestionables por software en tiempo real.

marsbitHace 43 min(s)

Develando el verdadero panorama de apalancamiento, liquidez y riesgos detrás de la tokenización de activos

marsbitHace 43 min(s)

Trading

Spot
活动图片