¡Anthropic ha revelado de antemano dos nuevas 'cartas'!
Hoy, en aplicaciones de desarrolladores de terceros y en la comunidad de Discord, aparecieron dos ID de modelo desconocidos:
- claude-mashmallow-eap (Malvavisco)
- claude-melon-eap (Melón)

Han surgido pruebas tempranas: Marshmallow muestra un rendimiento superior, con una naturalidad conversacional que supera a Opus 5, mientras que Melon es ligeramente inferior.
Sin embargo, sus capacidades generales no están al nivel de "Fable". Se lanzarán la semana que viene como muy pronto.
Mientras todo el mundo en internet seguía el chisme, Anthropic internamente 'explotó' una bomba:
Fable 5 lleva más de dos meses en línea, pero se enfrenta a un casi abandono colectivo.

Anthropic juega cartas de emergencia
Se filtra un nuevo modelo de Claude
Esta ronda de actualizaciones parece llegar con más urgencia que antes.
Los expertos del sector de la IA especulan que Marshmallow probablemente corresponde a una iteración de nivel Opus, quizás Opus 5.1.
Mientras que Melón se acerca más al nivel Sonnet.
Los resultados de una prueba SVG compartida por un usuario también ampliaron la brecha entre los dos modelos.


Anthropic aún no ha respondido oficialmente, pero las pistas comienzan a acumularse.


Si se tratara solo de una actualización normal, esto no sería extraño.
Lo realmente sutil es: ¿por qué precisamente ahora?
Después de todo, hace apenas dos meses, Anthropic acaba de poner sobre la mesa su carta más fuerte y cara.
Era Fable 5, la cima de la pirámide de Claude.
El poderoso Fable 5, sorprendentemente fracasa
Hace dos meses, Fable 5 hizo su debut con la aureola de 'buque insignia más fuerte' de Anthropic.
El más capaz, el más caro, y además la IA más avanzada de toda la línea de productos Claude.
Siguiendo la inercia de la industria, cuando se lanza un nuevo buque insignia, las grandes empresas suelen migrar rápidamente, inclinando el presupuesto hacia el modelo más nuevo y potente.
¡Esta vez, la regla falló con Fable 5!

La plataforma de pagos Ramp rastreó los datos de consumo de tokens de más de 70,000 empresas en EE. UU. y descubrió:
Un mes después del lanzamiento de Fable 5, solo había capturado el 6% de las llamadas de tokens de las empresas en Anthropic, con una cuota de gasto del 11.4%.
Ahora, después de más de dos meses, los últimos datos obtenidos por el FT muestran que esta cuota de gasto sigue rondando el 11%.
Es decir, son muy pocos los desarrolladores y grandes empresas realmente dispuestos a cambiar sus modelos a Fable 5.
Por el contrario, el buque insignia de OpenAI, GPT-5.6 Sol, se llevó durante el mismo período el 25% de los tokens y el 23% de la cuota de gasto.
En el mismo campo de juego, la cuota del modelo tope de gama de Anthropic es solo una cuarta parte que la de su competidor.
Lo más incómodo es que la contribución total de ingresos de Fable 5 es aproximadamente solo el 75% de la de GPT-5.6 Sol, aunque cuesta el doble por token.

¿Cuán caro es?
El precio unitario de Fable 5 es el doble que el del Opus 4.8 de Anthropic y 10 veces más caro que Haiku 4.5.
Aunque es poderoso, la mayoría de los escenarios diarios de las empresas ni siquiera requieren ese nivel.
El Opus 5 de la casa, contraataca al hermano mayor
Otro modelo de Anthropic es el 'golpe frontal' para Fable 5.
A finales de julio, Opus 5 hizo su aparición oficial, con un precio que es solo la mitad del de Fable 5, pero en evaluaciones de programación y trabajo de conocimiento, obtuvo mejores resultados.

Los resultados de la prueba CursorBench 3.2 son aún más directos:
Opus 5 obtuvo un 70% con el máximo poder de cómputo, coste por tarea $8.23. Fable 5 obtuvo un 70.5%, 0.5 puntos porcentuales más, pero costando $17.32.
Equivale a gastar el doble de dinero por solo un 0.5% más de rendimiento.
El resultado del voto con los pies de las empresas no es sorprendente: los datos de Ramp muestran que después del lanzamiento de Opus 5, su gasto rápidamente superó al de Fable 5.

Pero el problema es: si el modelo buque insignia es solo una 'vitrina', ¿por qué el mercado le da una valoración de 2 billones de dólares?
El código abierto pasó del 11% al 62% en solo cuatro meses
Además, la expansión frenética de la IA de código abierto también ejerce presión sobre Anthropic.
Según las estadísticas de Vercel AI Gateway:
En abril, la cuota de tokens de los modelos de código abierto era solo del 11%. Para junio, esta cifra se disparó al 29%. Los últimos datos de agosto alcanzaron directamente el 62%.
En solo dos meses, pasó de menos de un tercio a más del 60%. Y el dinero que gastan es menos del 4% del gasto total de las empresas.
En otras palabras, los modelos que hacen la mayor parte del trabajo casi no cuestan nada.

Esto hace que la posición de Fable 5 sea cada vez más incómoda.
Mirando hacia dentro, Opus 5, a la mitad del precio, ya está pisándole los talones; mirando hacia fuera, los modelos de código abierto siguen reduciendo los precios una y otra vez.
Por supuesto, Fable 5 puede seguir encargándose de empujar los límites de capacidad.
Pero lo que Anthropic necesita más ahora son modelos que las empresas estén realmente dispuestas a usar a largo plazo y a gran escala.
Visto así, la repentina aparición de Marshmallow (Malvavisco) y Melon (Melón) ya no es tan sorprendente.
Lo que pueden estar llenando es probablemente la pieza más crucial del 'combo familiar' de Claude:
Suficientemente fuerte, pero también suficientemente barato; capaz de mostrar músculo, pero sobre todo, que alguien esté dispuesto a pagar por ello.
Referencias:
https://x.com/kimmonismus/status/2091599817084412221?s=20
https://www.ft.com/content/5ee49718-c258-4f01-aa32-7e5b76ae5245?syn-25a6b1a6=1
Este artículo proviene de la cuenta oficial de WeChat "新智元" (New Zhiyuan), autor: ASI启示录, editor: 桃子





