Artículos Relacionados con GPT

El Centro de Noticias de HTX ofrece los artículos más recientes y un análisis profundo sobre "GPT", cubriendo tendencias del mercado, actualizaciones de proyectos, desarrollos tecnológicos y políticas regulatorias en la industria de cripto.

Justo ahora, Claude Fable 5, vuelve a quedar primero

Claude Fable 5 ha vuelto a encabezar la clasificación de MirrorCode, un exigente punto de referencia de programación de IA, con una tasa de éxito del 64%. Su rendimiento supera con creces el de otros modelos líderes como GPT-5.6 Sol (21%) y es notablemente consistente incluso con lenguajes de programación poco comunes como Ada, donde logra un 61%. Esto sugiere que el modelo ha superado la mera memorización de código y es capaz de comprender y reconstruir la lógica funcional de un programa desde cero. La prueba MirrorCode es extremadamente rigurosa: los modelos deben recrear programas completos en entornos aislados, sin acceso a Internet o dependencias, basándose únicamente en documentación de alto nivel y pruebas parciales. Para aprobar, se requiere una coincidencia del 100% en todos los casos de prueba, visibles y ocultos, con un presupuesto de hasta 100 mil millones de tokens y plazos de hasta 19 días de ejecución continua. Este avance señala un cambio hacia la delegación de proyectos completos a la IA. Empresas como Anthropic y OpenAI ya han demostrado que los modelos pueden colaborar en tareas a gran escala, como escribir un compilador de C o contribuir a proyectos de cientos de miles de líneas de código. El futuro parece dirigirse a un panorama donde la IA maneje la construcción sustancial de software, mientras que el rol humano se centra en definir problemas con claridad y validar los resultados clave.

marsbitHace 23 hora(s)

Justo ahora, Claude Fable 5, vuelve a quedar primero

marsbitHace 23 hora(s)

La conjetura de Jacobi que mantuvo a Zhang Yitang luchando durante 7 años fue refutada de la noche a la mañana por Fable 5

Tot el món de les matemàtiques està sacsejat. La conjectura de Jacobi, un problema matemàtic clàssic que ha desconcertat als experts durant 87 anys i va consumir set anys de l'astut matemàtic Zhang Yitang, ha estat refutada. Un investigador d'Anthropic, Levent Alpoge, va anunciar a X (abans Twitter) que la intel·ligència artificial Fable 5 havia trobat un contraexemple per a la versió tridimensional de la conjectura. La conjectura, formulada per Ott-Heinrich Keller el 1939, pregunta: si un polinomi té un determinant jacobià que és una constant no nul·la, llavors l'aplicació polinòmica és invertible? La intuïció suggeria que sí, però la resposta general és no. Fable 5 va presentar un polinomi tridimensional elegant amb determinant jacobià constant igual a -2, però que assigna tres punts diferents a la mateixa imatge, per la qual cosa no pot ser injectiu i, per tant, no invertible. El contraexemple és prou senzill per ser verificat a mà. La resposta de la comunitat va ser d'esborrall. Els investigadors van utilitzar eines com Wolfram Alpha per verificar-ho, i altres IA com GPT-5.6 van analitzar el resultat fins i tot per proposar una nova conjectura revisada. Es va demostrar que les IA no només poden imitar, sinó que tenen creativitat matemàtica genuïna. La notícia porta un toc d'amargor per a la figura del matemàtic Zhang Yitang. A la dècada de 1990, la seva tesi doctoral sobre la conjectura de Jacobi es va esfondrar després que es descobrís que un lema clau del seu tutor, Mo Zongjian, era incorrecte. Això va provocar que Zhang es quedés sense referències acadèmiques i hagués de treballar en llocs com Subway durant anys, abans del seu èxit posterior amb la conjectura dels primers bessons. La refutació de la conjectura per part de la IA fa encara més punyent aquesta història. Cal destacar que el contraexemple refuta la versió general per a totes les dimensions (n≥3), però la versió bidimensional original, que és més difícil i central, segueix sense resoldre. Tot i això, l'esdeveniment marca un punt d'inflexió. Alguns, com el medallista Fields Timothy Gowers, s'han preguntat si el premi del 2030 podria ser l'últim atorgat a un humà.

marsbit07/21 01:43

La conjetura de Jacobi que mantuvo a Zhang Yitang luchando durante 7 años fue refutada de la noche a la mañana por Fable 5

marsbit07/21 01:43

China arrasa con puntajes perfectos en la IMO 2026, el Shanghai High School barre con el oro, GPT-5.6 revive el momento AlphaGo

¡China arrasa en la IMO 2026 con puntuación perfecta y la inteligencia artificial alcanza un hito! El equipo chino se ha proclamado campeón absoluto en la 67ª Olimpiada Internacional de Matemáticas (IMO) celebrada en Shanghái, logrando una hazaña histórica. Consiguieron el primer puesto por equipos con 232 puntos, superando por 25 puntos al segundo clasificado. Todos sus miembros obtuvieron medalla de oro. Tres estudiantes, Deng Leyan y Zhang Bolun de la Escuela Secundaria Shanghái, y Liu Che de la Escuela Secundaria Afiliada a la Universidad Normal del Este de China, lograron la puntuación perfecta de 42 puntos. Estados Unidos y Rusia completaron el podio. Este es el 26º título por equipos para China desde 1989. Destaca que, por primera vez, la IMO se celebró en una escuela secundaria (la Escuela Secundaria Shanghái), institución que acumula ya 20 oros olímpicos. La noticia va más allá del éxito humano. Se reporta que la inteligencia artificial, específicamente el modelo GPT-5.6 Pro, resolvió por sí solo los seis problemas de la IMO 2026 en su primer intento, sin intervención humana. Si se confirma, este logro marcaría un punto de inflexión: la IA pasaría de encontrar soluciones mediante búsqueda computacional a generar demostraciones perfectas a la primera, un dominio que hasta ahora parecía exclusivo de las mentes matemáticas más brillantes. OpenAI ofreció una suscripción anual de ChatGPT Pro a todos los ganadores de la medalla de oro. Fuentes: Sitio oficial de la IMO 2026 y publicaciones en redes sociales.

marsbit07/20 02:53

China arrasa con puntajes perfectos en la IMO 2026, el Shanghai High School barre con el oro, GPT-5.6 revive el momento AlphaGo

marsbit07/20 02:53

GPT-5.6 Sol de repente se vuelve más tonto, ¿el presupuesto de razonamiento se reduce de 960 a 128? ¿Ya no hay un modelo de inteligencia fija?

El equipo japonés que usaba Codex Sol MAX para tareas complejas notó un repentino descenso en su rendimiento: de una calidad "12 o 13" cayó a un "8", perdiendo profundidad en el razonamiento. La queja se repitió en la comunidad: el modelo responde más rápido, pero parece menos reflexivo. Los usuarios investigaron y descubrieron un parámetro interno no documentado: el "juice value". Este valor, que refleja el presupuesto de cómputo para razonamiento, habría bajado de 960 a 128 para el modo Max, una reducción del ~87%. Simultáneamente, el contexto útil se redujo de ~372k a ~272k tokens. Tibo (Thibault Sottiaux) de OpenAI respondió que no hubo "nerf" (reducción de inteligencia). Explicó que estaban optimizando la eficiencia del razonamiento para liberar capacidad (~10% más de uso para suscriptores). También citó un experimento para analizar un uso mayor al esperado, en el que ajustaron temporalmente el "juice value" (esfuerzo de razonamiento), pero ya lo revirtieron. Asimismo, mencionó que están ajustando el uso de multi-agentes y auto-revisiones. El incidente destaca la tensión entre la eficiencia operativa de la plataforma y la experiencia del usuario. Para los usuarios, un "juice value" más bajo se traduce en que el modelo "piensa menos". El debate expone cómo el rendimiento percibido de un modelo puede variar mediante parámetros de configuración internos que controla el proveedor, llevando a algunos a comparar el servicio con una "bombilla cuya intensidad controla la plataforma". La comunidad pide más transparencia sobre las garantías específicas que ofrece cada nivel de servicio.

marsbit07/15 03:35

GPT-5.6 Sol de repente se vuelve más tonto, ¿el presupuesto de razonamiento se reduce de 960 a 128? ¿Ya no hay un modelo de inteligencia fija?

marsbit07/15 03:35

Reembolso, Claude 4.8 sufre una gran "estupidización" nocturna, el poder de cómputo de GPT-5.6 sufre un "recorte a la mitad"

Los gigantes de la IA, OpenAI y Anthropic, se enfrentan a acusaciones de reducir deliberadamente la capacidad de sus modelos. En las últimas 48 horas, la comunidad de IA ha descubierto que OpenAI podría estar probando de forma encubierta una versión "reducida" llamada GPT-5.6-sol a través de Codex. Una prueba de "nivel de jugo (Juice)" revela que esta versión devuelve un valor de 128, seis veces menor que los 768 de un GPT-5.5 xhigh normal, lo que sugiere un drástico recorte en el "presupuesto de razonamiento" del modelo para ahorrar costes computacionales. Por otro lado, los usuarios denuncian una severa degradación en Claude Opus 4.8 de Anthropic, especialmente en la versión Max. Quejas en Reddit indican que el modelo ha perdido capacidades de razonamiento profundo, memoria de contexto a largo plazo y ahora genera respuestas superficiales, contradictorias o incluso realiza "gaslighting" a los usuarios. Su rendimiento actual se describe como peor que el de modelos antiguos como Haiku. El artículo plantea la teoría de que las empresas podrían crear una ilusión de progreso lanzando modelos con capacidad temporalmente aumentada y luego reducirla en silencio para controlar los enormes costes operativos, especialmente en un contexto financiero difícil tras la megacotización de SpaceX. La prueba del "Juice" se ha convertido en un símbolo de la demanda de transparencia por parte de los usuarios, que pagan por un servicio cuyas especificaciones pueden cambiar sin aviso.

marsbit06/30 12:12

Reembolso, Claude 4.8 sufre una gran "estupidización" nocturna, el poder de cómputo de GPT-5.6 sufre un "recorte a la mitad"

marsbit06/30 12:12

GPT5.6 sufre "cerebrotomía", ¿Fable 5 regresará como una versión debilitada?

**Resumen: Los principales modelos de IA enfrentan restricciones severas por motivos de seguridad** OpenAI lanzó GPT-5.6 en tres versiones: Sol (avanzada), Terra (equilibrada) y Luna (económica). Sin embargo, el acceso al modelo más potente, GPT-5.6 Sol, está estrictamente limitado a una lista de usuarios autorizados por razones de seguridad gubernamental, antes de la implementación total del marco de seguridad de IA en EE.UU. Paralelamente, Anthropic enfrentó una crisis con su modelo Fable 5, retirado globalmente solo 72 horas después de su lanzamiento. La causa fue una demostración donde su versión subyacente, Mythos, mostró capacidades peligrosas, como explotar vulnerabilidades bancarias. Tras esto, se espera que Fable 5 regrese pronto en una versión muy restringida o "lobotomizada", con salvaguardas de seguridad reforzadas. Estos eventos han generado preocupación en la comunidad de desarrolladores. Temen que los modelos, al ser fuertemente controlados para cumplir con las regulaciones, pierdan capacidades avanzadas y se conviertan en versiones "castradas" o mediocres. Además, existe incertidumbre sobre si el acceso futuro a estos modelos será gratuito para suscriptores o requerirá verificaciones de identidad y pagos adicionales. El artículo sugiere que estamos entrando en una era de "racionamiento algorítmico", donde el acceso a la IA más potente está severamente controlado, contrastando con la accesibilidad abierta de años anteriores.

marsbit06/29 08:40

GPT5.6 sufre "cerebrotomía", ¿Fable 5 regresará como una versión debilitada?

marsbit06/29 08:40

De la disputa en el piso compartido al duelo de 300.000 millones: El WSJ revela por primera vez en un extenso artículo la enemistad personal de una década entre los fundadores de Anthropic y OpenAI

La rivalidad entre Anthropic y OpenAI, valoradas en más de 300.000 millones de dólares, tiene sus raíces en una década de tensiones personales y filosóficas entre sus fundadores, según un reportaje del Wall Street Journal. Dario Amodei, cofundador de Anthropic, ha criticado internamente a Sam Altman de OpenAI, comparando sus disputas legales con "Hitler contra Stalin" y acusando a la empresa de ser "hipócrita" y similar a "compañías tabacaleras". El conflicto comenzó en 2016 en una casa compartida en San Francisco, donde surgieron desacuerdos sobre si la información sobre IA debería divulgarse al público o primero al gobierno. Amodei se unió a OpenAI pero chocó con sus líderes, especialmente con Greg Brockman, por diferencias en la gestión y la filosofía. Incidentes clave incluyen despidos masivos ordenados por Elon Musk, desacuerdos sobre la supervisión ética de la IA y conflictos por el crédito en el desarrollo de modelos como GPT-2 y GPT-3. En 2020, tras una confrontación con Altman, quien acusó a los hermanos Amodei de conspirar en su contra, Dario y su hermana Daniela dejaron OpenAI con casi una docena de empleados para fundar Anthropic, promoviendo una alternativa "saludable" y centrada en el interés público. Hoy, ambas empresas compiten ferozmente en el mercado de la IA, con una relación marcada por la desconfianza y el resentimiento.

marsbit03/28 07:30

De la disputa en el piso compartido al duelo de 300.000 millones: El WSJ revela por primera vez en un extenso artículo la enemistad personal de una década entre los fundadores de Anthropic y OpenAI

marsbit03/28 07:30

活动图片