Илья сдаёт экзамен, Хуан Жэньсюнь ставит 50 млрд на SSI, первая модель может быть выпущена на этой неделе
Согласно сообщениям, лаборатория Safe Superintelligence (SSI), основанная Ильёй Суцкевером, может представить свою первую революционную модель уже на этой неделе. Инвесторы и наблюдатели в области технологий, включая партнера a16z Мартина Касадо, намекают на грядущий прорыв, который способен кардинально изменить игровое поле в сфере ИИ. Подкреплением этих слухов стало стратегическое партнерство с NVIDIA, которая инвестировала 5 миллиардов долларов и предоставила эксклюзивный доступ к своим передовым вычислительным системам после получения редкой возможности ознакомиться с исследованиями SSI.
Ключевым нововведением модели SSI, как сообщается, является архитектура на основе «обучения во время тестирования» (Test-Time Training, TTT). В отличие от современных моделей, таких как ChatGPT, которые работают с зафиксированными во время предварительного обучения знаниями или расширенным контекстом, подход TTT позволяет модели динамически обновлять свои веса (параметры) в процессе взаимодействия с данными. Это означает, что модель не просто обрабатывает информацию, а реально «учится» на ней, непрерывно адаптируясь и эволюционируя, подобно человеку.
Эта философия соответствует давнему видению Суцкевера, который неоднократно заявлял о конце эпохи масштабирования предварительного обучения и переходе к эре, где истинный искусственный интеллект должен быть способен к непрерывному обучению. Цель SSI — создать безопасный сверхинтеллект, который изначально является не всезнающей системой, а, скорее, «гениальным 15-летним» с безграничным любопытством и способностью осваивать любые навыки через практику и обратную связь.
Если SSI действительно представит рабочую модель с возможностями TTT, это может положить начало новой парадигме в индустрии ИИ, бросив вызов существующим бизнес-моделям, построенным вокруг больших контекстных окон и огромных затрат на предобучение.
marsbit5 мин. назад