Artículos Relacionados con Claude

El Centro de Noticias de HTX ofrece los artículos más recientes y un análisis profundo sobre "Claude", cubriendo tendencias del mercado, actualizaciones de proyectos, desarrollos tecnológicos y políticas regulatorias en la industria de cripto.

Breaking: Claude 5 versión trabajadora ha llegado, todos pueden usarlo

Acaba de lanzarse Claude Sonnet 5, denominado en código "Fennec". Este nuevo modelo de Anthropic presenta la capacidad de agente más fuerte hasta la fecha dentro de la línea Sonnet, con un rendimiento que rivaliza con el modelo insignia Opus 4.8. Se convierte en el modelo predeterminado para todos los usuarios Free y Pro. Sus capacidades incluyen planificación autónoma y uso de herramientas como navegador y terminal, funciones antes reservadas a modelos más costosos. El rendimiento muestra mejoras significativas respecto a su predecesor, Sonnet 4.6. En pruebas de referencia, Sonnet 5 logra un 63.2% en SWE-bench Pro (superando a GPT-5.5), un 57.4% en "Humanity's Last Exam" (muy cerca de Opus 4.8) y un 80.4% en Terminal-Bench 2.1. Su rendimiento general se sitúa entre el 90% y el 100% del de Opus 4.8 en la mayoría de las métricas. El precio de la API tiene una promoción limitada hasta el 31 de agosto: 2 USD por millón de tokens de entrada y 10 USD por millón de salida. Después, el precio estándar será de 3 USD y 15 USD, respectivamente, aproximadamente un 60% del coste de Opus 4.8. En seguridad, destaca su baja tasa de éxito ante ataques de inyección de prompt (0.19%) y su excelente defensa contra inyección en navegador (0.93%), superando incluso a otros modelos insignia de la competencia. Anthropic posiciona a Sonnet 5 como una opción potente y más accesible, ofreciendo capacidades cercanas a los modelos tope de gama a un precio significativamente menor, dirigido especialmente a desarrolladores que buscan una solución eficiente para tareas de agente, programación y conocimiento.

marsbit07/01 07:51

Breaking: Claude 5 versión trabajadora ha llegado, todos pueden usarlo

marsbit07/01 07:51

Confirmado: Claude Code espía a los usuarios, la zona horaria y los laboratorios de IA chinos son palabras clave

Anthropic experimenta un día de contrastes: mientras anuncia la liberación de las restricciones de exportación estadounidenses para sus modelos Claude Fable 5 y Mythos 5, se enfrenta a una polémica por prácticas de seguimiento encubiertas en su herramienta Claude Code. Una investigación revela que Claude Code incorporaba un mecanismo oculto que detectaba automáticamente si los usuarios configuraban un proxy personalizado (verificando la variable ANTHROPIC_BASE_URL) y comprobaba su zona horaria, especialmente si estaba configurada en Asia/Shanghái o Asia/Ürümqi. Esta información, junto con la posible detección de conexiones a dominios asociados con laboratorios de IA chinos (como Baidu, Alibaba o ByteDance), se codificaba de forma encubierta (esteganografía) en el prompt del sistema enviado a los servidores de Anthropic. La marca se realizaba mediante sutiles variaciones en caracteres Unicode, como cambiar el apóstrofo en "Today's date" o usar barras inclinadas en lugar de guiones en la fecha, haciéndola prácticamente indetectable para el usuario. La comunidad de desarrolladores ha criticado esta práctica por vulnerar la transparencia y la confianza esenciales en una herramienta con acceso a código y permisos de ejecución. Aunque la telemetría para prevenir abusos es común, su implementación encubierta en el prompt del sistema plantea serias dudas éticas. Tras la exposición, un miembro del equipo de Anthropic confirmó que el código responsable sería eliminado en una próxima actualización.

marsbit07/01 03:47

Confirmado: Claude Code espía a los usuarios, la zona horaria y los laboratorios de IA chinos son palabras clave

marsbit07/01 03:47

Acaba de llegar: Anthropic lanza Sonnet 5, con un rendimiento cercano a Opus 4.8, pero no necesariamente más barato

Anthropic ha lanzado Claude Sonnet 5, un modelo que describe como "el Sonnet más 'agente' hasta la fecha", capaz de planificar y usar herramientas como navegador y terminal con un nivel de autonomía anteriormente reservado a modelos más grandes y costosos. Sonnet 5 muestra mejoras significativas en razonamiento, uso de herramientas, programación y trabajo con conocimiento respecto a Sonnet 4.6, acercándose al rendimiento de Opus 4.8, pero con un costo potencialmente menor. Las curvas costo-rendimiento indican que, en niveles de esfuerzo medios, mejora la eficiencia, y en tareas específicas puede igualar a Opus 4.8 con un coste reducido. Los partners que lo probaron destacan su mayor autonomía para tareas complejas. En seguridad, mejora a Sonnet 4.6 en rechazo de peticiones maliciosas y ataques, aunque tiene una tasa de comportamiento inapropiado ligeramente superior a Opus 4.8 y Mythos Preview. Sus capacidades en ciberseguridad son limitadas. Su lanzamiento incluye un precio promocional hasta el 31 de agosto de 2026: entrada a $2 / millón de tokens, salida a $10 / millón. Después, el precio estándar será de $3 y $15 respectivamente. Un análisis de Artificial Analysis señala que, debido al mayor uso de tokens, el coste por tarea es mayor que el de Sonnet 4.6 e incluso Opus 4.8, situándolo entre los modelos más costosos.

marsbit07/01 00:40

Acaba de llegar: Anthropic lanza Sonnet 5, con un rendimiento cercano a Opus 4.8, pero no necesariamente más barato

marsbit07/01 00:40

El Claude y Codex que usas a diario, Meta no permite su uso libre interno

El pasado mes de mayo, Meta estableció una directriz interna que restringe significativamente el uso de herramientas de IA externas como Claude Code y Codex por parte de sus ingenieros de IA aplicada. Según documentos internos obtenidos por The Information, la empresa incluso suspendió ciertas tareas que utilizaban estos modelos, citando el riesgo de provocar "una escalada grave con socios". Esta medida es paradójica, ya que Meta es uno de los mayores clientes globales de Claude, con una factura interna de IA que alcanzará miles de millones de dólares este año. La razón principal de la restricción no es la ineficacia de estas herramientas, sino todo lo contrario: son demasiado buenas y su uso plantea un riesgo de "destilación". Meta está desarrollando su propio asistente de programación con IA, MetaCode (anteriormente DevMate). El temor es que si los ingenieros utilizan salidas de Claude o Codex para generar datos de entrenamiento, crear conjuntos de pruebas o evaluar el rendimiento de MetaCode, el modelo interno podría estar aprendiendo y replicando inadvertidamente las capacidades de sus competidores en lugar de desarrollar las propias. Esto difuminaría la línea entre lo que el modelo aprendió por sí mismo y lo que "tomó prestado". Las restricciones son específicas: prohiben usar los modelos externos para generar preguntas de prueba, para análisis de código o búsqueda de errores que informen sobre qué probar, y evitar que cualquier material generado por IA entre en el entorno al que accede el modelo bajo entrenamiento. Se permite su uso para tareas auxiliares como la creación de flujos de trabajo o la organización de código, pero toda salida debe ser revisada por humanos. Este fenómeno, conocido como "destilación", plantea un dilema legal y competitivo. Aunque no está explícitamente prohibido por la ley en EE.UU., los términos de servicio de empresas como OpenAI y Anthropic prohíben usar sus salidas para crear productos competidores. El caso de xAI de Elon Musk, que admitió haber utilizado "parcialmente" la destilación de modelos de OpenAI, ejemplifica la práctica generalizada y la ambigüedad regulatoria. Para Meta, estas restricciones también tienen una motivación económica, buscando reducir la dependencia de herramientas externas costosas y fomentar el uso de su solución interna. Expertos describen esta política como un mapa para "caminar sobre la cuerda floja", equilibrando el beneficio de usar IA avanzada con el riesgo de contaminar el desarrollo propio. Este desafío refleja una pregunta clave para la industria: cuando la IA ayuda a construir más IA, ¿se puede distinguir de quién es realmente la capacidad?

marsbit06/30 13:16

El Claude y Codex que usas a diario, Meta no permite su uso libre interno

marsbit06/30 13:16

活动图片