Anthropic предупреждает о рекурсивном ИИ: новая компания Тянь Юаньдуна только что сделала «первый шаг»
Недавно Anthropic опубликовала статью «Когда ИИ создаёт себя», вызвавшую широкое обсуждение. В ней раскрываются впечатляющие данные: к маю 2026 года более 80% кода в их репозитории написан Claude, а объёмы кода, сливаемого инженерами ежедневно, выросли в 8 раз по сравнению с 2024 годом. Claude также ускорил один обучающий код примерно в 52 раза, в то время как опытному исследователю потребовалось бы 4-8 часов для ускорения в 4 раза. Anthropic указывает на цель — «рекурсивное самоулучшение», когда ИИ автономно проектирует, строит и обучает свои последующие версии.
Теперь компания Recursive Superintelligence, соучредителем которой является Тянь Юаньдун, сделала «первый шаг» к автоматизации исследований ИИ. Они создали открытую систему автоматического открытия знаний и достигли лучших результатов (SOTA) в трёх бенчмарках, позволив ИИ проводить эксперименты.
Их система автоматизирует традиционный цикл исследований «идея — код — эксперимент — анализ» и работает в трёх различных областях:
1. **Тренировка небольшой модели с фиксированным бюджетом вычислений (NanoChat Autoresearch):** Система улучшила результат, сократив валидационный BPB с 0.9372 до 0.9109, что эквивалентно достижению того же качества обучения за в 1.3 раза меньше времени.
2. **Скоростное обучение модели (NanoGPT Speedrun):** На 8 GPU H100 система сократила время обучения модели GPT до целевого уровня потерь с 79.7 секунд до 77.5 секунд, внедрив такие улучшения, как вычисления внимания в FP8, затухающий шум в оптимизаторе и более эффективное ядро MLP.
3. **Оптимизация GPU ядер (SOL-ExecBench):** В этом специализированном бенчмарке NVIDIA, содержащем 235 задач, система повысила общий балл с 0.699 до 0.754, приблизившись к теоретическому аппаратному пределу на 18%.
Recursive подчёркивает, что это лишь «первый шаг». Их система наиболее эффективна в задачах с чёткими метриками и быстрой обратной связью, а предотвращение «взлома награды» остаётся ключевой проблемой. Тем не менее, их работа представляет собой конкретную реализацию новой парадигмы — рекурсивного ИИ, способного ускорять собственный прогресс. Это происходит на фоне предупреждений Anthropic о необходимости координации и потенциальных пауз в разработке перед лицом быстрого рекурсивного самоулучшения.
marsbit06/12 04:13