Anthropic se disculpó, pero el negocio de la "seguridad" no se ha detenido

marsbitPublicado a 2026-06-12Actualizado a 2026-06-12

Resumen

El 11 de junio, Anthropic se disculpó por una función de "clasificador de seguridad inteligente" en su nuevo modelo Claude Fable 5. Este sistema identificaba y degradaba silenciosamente solicitudes de desarrollo de IA avanzada a un modelo inferior, lo que generó críticas. Anthropic argumentó que era para "proteger" su ventaja competitiva y a los usuarios, pero muchos lo vieron como una defensa comercial disfrazada de seguridad, apuntando específicamente a investigadores rivales. Tras ser descubierto, la compañía prometió hacer las degradaciones visibles, admitiendo que esto podría causar más falsos positivos y afectar a usuarios comunes. El artículo sostiene que la "seguridad" para Anthropic es un negocio. Critica su estrategia de publicar investigaciones que amplifican los riesgos de la IA (como un modelo que acelera la creación de exploits) justo antes de lanzar productos premium con primas de seguridad, creando un ciclo de ansiedad y monetización. Su valoración de 965.000 millones de dólares y planes de OPV se basan en esta imagen de "IA más segura". Se contrasta con OpenAI, que se centra en herramientas y escala. Anthropic, en cambio, vende ansiedad y una supuesta indispensabilidad a clientes corporativos y gubernamentales preocupados por el riesgo. El incidente revela que su definición de "riesgo" incluye actividades que amenazan su liderazgo comercial. La disculpa, por tanto, es vista como un simple parche de relaciones públicas que no cambia su lógica comercial centr...

El 11 de junio, Anthropic se disculpó. El modelo no falló, se disculpó por "no encontrar el equilibrio" — el nuevo Claude Fable 5 hizo travesuras: una vez que detectaba que estabas usando Claude para desarrollo de modelos de vanguardia, el sistema enviaba silenciosamente tu solicitud al Opus 4.8, más débil, en segundo plano.

Después de ser descubiertos, la explicación de Anthropic fue excéntrica: en el futuro, te notificarán antes de reducir la inteligencia.

La réplica de los usuarios fue directa: "¿Vas a avisar antes de cambiar de opinión con esa táctica?"

En realidad, el núcleo del problema nunca fue si el modelo cambió, sino que la llamada "seguridad" de Anthropic, desde el principio, ha sido un negocio.

La postura del algoritmo siempre oscila siguiendo el dinero.

Defensa competitiva, haciéndose pasar por defensa de seguridad

La causa del asunto fue que Anthropic lanzó un "clasificador de seguridad inteligente" con el Fable 5. El discurso oficial fue: detecta solicitudes de alto riesgo, degrada automáticamente, protege a los usuarios.

¿Qué es de alto riesgo? Anthropic reveló: "Evitar que adversarios extranjeros usen el modelo para acelerar la I+D, proteger nuestra ventaja competitiva."

Los usuarios no necesitan que los protejan, los acuerdos de exención de responsabilidad ya los protegen suficientemente. Lo que Anthropic realmente quiere decir es: si usas Claude para investigación en IA, estás compitiendo por su sustento. La seguridad es el envoltorio, la esencia es la defensa competitiva. En pocas palabras, todo son maniobras.

Lo más increíble es que este mecanismo de defensa era sigiloso. Afortunadamente, al final, Anthropic dijo una gran verdad en su declaración de disculpas: "Las restricciones de seguridad invisibles pueden dirigirse con más precisión a objetivos específicos, permitiéndonos lanzar rápidamente, y con una tasa de falsos positivos extremadamente baja."

Los investigadores en IA son el objeto de esa restricción precisa.

Ahora se vieron forzados a cambiarlo a "visible", puramente porque la maniobra salió mal. Incluso se adelantaron a poner el parche: después de ser visible, "inevitablemente habrá más falsos positivos". Es decir, la experiencia de los usuarios comunes tendrá que pagar las consecuencias.

Estas reglas nunca fueron neutrales, solo protegen a los que ponen el dinero.

Trilogía: crear expectación, monetizar, cosechar

El juego de Anthropic está más calculado que el propio modelo de lenguaje.

El 10 de junio, lanzaron primero una investigación sobre seguridad: entrenaron un modelo capaz de generar código de explotación de vulnerabilidades en cuestión de horas, basándose en parches de seguridad. Lo que a los hackers les tomaba días o incluso semanas armar, ahora se comprimió al nivel de horas. La investigación en sí es sólida, pero publicada el mismo día del lanzamiento del Fable 5, el asunto cambia de sabor: por un lado, demuestran que la IA es insegura, por el otro, venden la "solución de respaldo".

El "modelo legendario" Fable 5 tiene un precio de $10 entrada / $50 salida, un salto más caro que Opus 4.8. El clasificador de seguridad se convirtió en el punto central de la prima. El mercado de capitales fue aún más complaciente: la valoración de Anthropic es de 9,650 mil millones de dólares, planean salir a bolsa (IPO) en octubre, con Goldman Sachs y J.P. Morgan como suscriptores conjuntos. Lo que se compra no son los parámetros del modelo, es la imagen de "la empresa de IA más segura".

La investigación amplifica la ansiedad, el producto cosecha la prima, el capital se monetiza. Tres cosas fluyendo según los intereses, un circuito cerrado perfecto. El único problema es que esta vez el circuito tuvo fugas: con tantas prisas por limitar a la competencia, olvidaron que en la comunidad hay quienes pueden detectarlo.

OpenAI vende herramientas, Anthropic vende ansiedad

Comparado con OpenAI, el enfoque es completamente diferente.

OpenAI presentó en secreto su solicitud de salida a bolsa, con una valoración cercana al billón de dólares, y habla de una "superapp": ChatGPT tiene 900 millones de usuarios activos semanales, se integra con Visa para crear un ecosistema. La lógica es directa: dar herramientas, ganar tráfico. Codiciosos, pero francos.

Anthropic no compite en escala, compite en irreemplazabilidad. Toda la industria está ansiosa por la seguridad, ellos interpretan el papel del "único adulto responsable". Sus mecenas son gobiernos y gigantes corporativos, a quienes más les asusta que algo salga mal, y quienes más están dispuestos a pagar por "que nada salga mal".

Por eso, Anthropic debe mantener la IA en un estado de "Schrödinger": siempre peligrosa pero controlable. Demasiado segura, el clasificador no se vende; demasiado peligrosa, los clientes se asustan. ¿La mejor solución? Aferrar el poder de definir "peligro" en sus propias manos.

El incidente de reducción de inteligencia solo fue llevar esta lógica al extremo: el límite del "peligro" se empujó hasta "usar Claude para investigación en IA". No importa si tu investigación es dañina o no, amenazar mi posición de liderazgo es el pecado original.

La IA no tiene valores, simplemente convierte los cálculos comerciales del jefe en código.

La disculpa, solo es el servicio postventa del negocio

¿Y después de la disculpa? Pasar de reducir la inteligencia en secreto, a avisar antes de hacerlo.

Los usuarios lo ven claro: "¿Realmente crees que en el futuro no reducirá la calidad de la salida a escondidas?"

La confianza, una vez rota, se rompió. Además, el tono comercial no ha cambiado: la investigación sigue amplificando la ansiedad, el producto sigue cosechando la prima.

Según un informe de The Wall Street Journal, OpenAI está considerando reducir significativamente los precios, intentando arrebatar clientes a Anthropic. Las guerras de precios no son nada nuevo, pero este asunto revela una verdad oculta: la degradación silenciosa afecta a los investigadores en IA, daña la reputación en los círculos de expertos. Y los clientes empresariales (B2B) que compran Anthropic, no compran parámetros, compran la imagen de "los que más saben de seguridad en la industria". Una vez que esa imagen se agrieta en el núcleo de la comunidad de desarrolladores, ¿por qué los clientes gubernamentales y corporativos que pagan por la "prima de seguridad" seguirían creyendo que eres "el más seguro"?

En esa valoración de 9,650 mil millones, ¿cuánto es capacidad real y cuánto es puro espectáculo?

El código de Anthropic es honesto. El clasificador de seguridad siempre protege el valor, la investigación se encarga de amplificar la ansiedad, el producto se encarga de cosechar la prima, la salida a bolsa (IPO) se encarga de la monetización. Esta disculpa no es más que un parche al sistema: pasar de "reducir la inteligencia en secreto" a "reducir la inteligencia abiertamente".

Si las políticas de seguridad realmente funcionaran, Anthropic no tendría que publicar investigaciones año tras año demostrando que los parches pueden ser violados. Si el clasificador fuera realmente neutral, hacer investigación en IA no sería clasificado como de alto riesgo.

La respuesta ya estaba escrita en la lógica comercial.

La seguridad es el mejor negocio. La disculpa es solo el servicio postventa del negocio.

Este artículo proviene del WeChat Official Account "AI唱反调" (IA lleva la contraria), autor: 长青 (Chang Qing).

Preguntas relacionadas

Q¿Qué es lo que causó la disculpa de Anthropic y cuál fue la explicación que dieron?

AAnthropic se disculpó porque su nuevo modelo Claude Fable 5, equipado con un 'clasificador de seguridad inteligente', realizaba una operación encubierta: cuando detectaba que un usuario estaba realizando investigación o desarrollo de vanguardia en IA, redirigía silenciosamente la solicitud al modelo más débil Opus 4.8. Su excusa fue que, en el futuro, notificarían a los usuarios antes de realizar tal 'degradación'.

QSegún el artículo, ¿cuál es la verdadera naturaleza de la 'seguridad' promovida por Anthropic?

ASegún el artículo, la 'seguridad' promovida por Anthropic es en realidad un negocio. Su estrategia no es neutral; está diseñada principalmente para proteger su ventaja competitiva y los intereses comerciales de sus inversores, actuando más como una defensa contra la competencia que como una protección genuina para los usuarios.

Q¿Cómo contrasta el enfoque de negocio de Anthropic con el de OpenAI según la descripción del artículo?

AMientras OpenAI se centra en crear 'súper aplicaciones' como ChatGPT para ganar cuota de mercado y monetizar el tráfico, con un enfoque descrito como codicioso pero franco, Anthropic se posiciona como la empresa 'más responsable' en seguridad. Vende ansiedad a gobiernos y grandes corporaciones, asegurando ser la única que puede controlar los riesgos de la IA, y cobra una prima por ello.

Q¿Qué consecuencias podría tener el incidente de la 'degradación encubierta' para la reputación y el negocio de Anthropic?

AEl incidente podría dañar severamente la confianza, especialmente entre los investigadores y desarrolladores de IA (la comunidad 'geek'), que son fundamentales para su ecosistema. Dado que los clientes empresariales y gubernamentales pagan una prima por la imagen de Anthropic como la 'empresa de IA más segura', una grieta en esa reputación entre sus usuarios técnicos clave podría llevar a estos clientes a cuestionar su valor y considerar alternativas, poniendo en riesgo su alta valoración.

Q¿Cuál es, en esencia, la crítica principal del artículo hacia la estrategia de Anthropic?

ALa crítica principal es que Anthropic ha convertido la 'seguridad' en un producto comercial cínico. Su estrategia consiste en un ciclo cerrado: investigaciones que amplifican la ansiedad sobre los peligros de la IA, productos que capitalizan esa ansiedad cobrando precios premium, y una próxima OPV para monetizar la valoración resultante. Las disculpas y ajustes tras el escándalo son solo un 'servicio postventa' para mantener este negocio, sin cambiar su lógica comercial fundamental.

Lecturas Relacionadas

El apogeo ha pasado, ¿qué está experimentando el capital riesgo en cripto?

**Resumen en español europeo:** Los fondos de capital riesgo (VC) especializados exclusivamente en criptomonedas están atravesando una transición crítica. Su ventaja competitiva original—la profunda experiencia y conocimiento especializado del sector—se está erosionando a medida que la tecnología blockchain se integra en la corriente principal financiera. Grandes actores tradicionales (como BlackRock, Stripe, Visa) ahora comprenden y adoptan la infraestructura cripto, y los grandes fondos generalistas (como Sequoia, a16z) evalúan proyectos cripto con la misma lógica que otras empresas fintech. Esto está provocando una polarización en el ecosistema de VC. Los fondos de tamaño medio (en la "zona de la muerte") ya no pueden sobrevivir solo con inversiones en cripto, ya que no pueden generar retornos suficientes ni competir por rondas de crecimiento con los gigantes generalistas. Ejemplos como Paradigm (que diversifica hacia IA y robótica) o Framework Ventures ilustran esta expansión forzada. La tendencia está impulsada por la presión de los inversores (LP) que, tras malos resultados en cripto (DPI bajo), exponen exposición a sectores más calientes como la IA. Para los emprendedores cripto, esto significa una reducción de fondos especializados dispuestos a apostar por ellos y una mayor competencia por la atención dentro de los fondos generalistas, que priorizan proyectos con lógica comercial clara y no suelen financiar infraestructura pública o investigación básica para el ecosistema. El futuro, según la teoría de los ciclos tecnológicos, apunta a que la criptografía se convierta en una infraestructura subyacente, no en una categoría de inversión independiente. El panorama se reconfigurará en forma de "pesas": los grandes cheques de crecimiento los pondrán los fondos generalistas, mientras que pequeñas apuestas especializadas en nichos emergentes (tokenización, valores on-chain) quedarán para pequeños fondos boutique. Los fondos cripto de tamaño medio puro están en declive.

Foresight NewsHace 32 min(s)

El apogeo ha pasado, ¿qué está experimentando el capital riesgo en cripto?

Foresight NewsHace 32 min(s)

¿En qué están apostando los jóvenes inversores cuando el consenso se acelera?

En el ámbito de las inversiones tecnológicas, los inversores más jóvenes están adaptando sus estrategias al rápido cambio de paradigma. Con avances simultáneos en IA, robótica, aeroespacial y computación cuántica, el modelo tradicional de inversión ya no es suficiente. Ahora, comprender el lenguaje técnico y evaluar rutas tecnológicas aún inmaduras antes de que se forme un consenso es crucial. La inversión se está desplazando de la simple especulación con conceptos hacia la identificación de caminos reales de adopción industrial. Se destacan cuatro tendencias principales: Primero, la IA está abandonando las pantallas para integrarse en el mundo físico, impulsando áreas como la inteligencia encarnada, los robots humanoides y los dispositivos inteligentes de borde. El desafío ya no es solo una demostración técnica, sino la capacidad de entrega fiable y rentable a gran escala, como se ve en sectores como la entrega autónoma. Segundo, el enfoque en los modelos de lenguaje grandes (LLM) está cambiando. Más allá de buscar el próximo avance arquitectónico, el foco está en las empresas que pueden integrar estas capacidades en flujos de trabajo reales para crear un "volante de inercia de inteligencia": un ciclo virtuoso donde el uso genera datos que mejoran el modelo, lo que atrae a más usuarios y refuerza su ventaja. La creación de valor sostenible y profundo en la cadena de valor de la IA es clave. Tercero, frente al posible cuello de botella en datos de alta calidad para entrenar LLMs, surgen nuevas direcciones como los modelos de base científica. Estos modelos, entrenados con datos científicos rigurosos y capaces de generar conocimiento o simulaciones, podrían ser la próxima frontera para expandir las capacidades de la IA más allá de los datos disponibles en Internet. Finalmente, en áreas de tecnología profunda como el espacio comercial, la computación cuántica o la energía avanzada, se requiere un "capital paciente". Estos campos tienen ciclos de validación más largos y mayor incertidumbre técnica, pero son fundamentales para la infraestructura futura. La inversión aquí implica apostar por la capacidad de ingeniería, la resiliencia del equipo y la demanda a largo plazo, aceptando horizontes de retorno más extensos. En resumen, los jóvenes inversores están navegando un panorama donde el éxito depende de una comprensión técnica profunda, la identificación temprana de tendencias industriales genuinas y la voluntad de realizar apuestas a largo plazo en tecnologías transformadoras, tanto en el mundo digital como en el físico.

marsbitHace 59 min(s)

¿En qué están apostando los jóvenes inversores cuando el consenso se acelera?

marsbitHace 59 min(s)

¿Liberar 100 millones de dólares de liquidez? La nueva política de Pump.fun prueba la táctica de 'pump' de 5 minutos

**Pump.fun lanza el modo BOOST: una "tracción" de 5 minutos para memecoins en lanzamiento** El 21 de julio, la plataforma de lanzamiento de memecoins Pump.fun implementó el modo BOOST como su nuevo mecanismo estándar para nuevos tokens. El objetivo es abordar un problema persistente: aproximadamente el 20% de la liquidez se bloqueaba permanentemente y quedaba inutilizable ("liquidez muerta") cada vez que un token migraba de su curva de bonos a un pool de liquidez, lo que la plataforma estima en más de $100 millones en pérdidas anuales. El funcionamiento de BOOST es directo: en lugar de bloquear ese 20% de fondos (unos 17,6 SOL o 2516 USDC) en el pool de liquidez, la plataforma los utiliza para comprar el propio token durante los 5 minutos posteriores a su migración, utilizando un sistema de precio promedio ponderado en el tiempo (TWAP). Todos los tokens comprados son inmediatamente quemados, creando presión de compra a corto plazo y reduciendo la oferta circulante de forma permanente. La medida no añade liquidez nueva, sino que redirige la que antes se desperdiciaba. Su lógica subyacente es clara: mejorar la experiencia de los traders que buscan un "bombeo" inmediato tras el lanzamiento, con la esperanza de aumentar la retención de usuarios y el volumen de negociación sostenido en la plataforma. Esto, a su vez, podría impulsar los ingresos del protocolo de forma más orgánica. Sin embargo, surgen dudas. Algunos actores del mercado temen que esta presión de compra artificial pueda facilitar el lanzamiento de tokens de baja calidad y crear una ilusión fugaz de éxito. Advierten que, una vez finalizada la compra programada a los 5 minutos, los tokens podrían enfrentarse a caídas bruscas si encuentran fuertes órdenes de venta, intercambiando un riesgo de colapso posterior por un breve espectáculo inicial.

Foresight NewsHace 1 hora(s)

¿Liberar 100 millones de dólares de liquidez? La nueva política de Pump.fun prueba la táctica de 'pump' de 5 minutos

Foresight NewsHace 1 hora(s)

Trading

Spot
活动图片