Треть arXiv оказалась под вопросом: 65% статей по CS пахнут «ИИ-привкусом», а математика — лишь 0,7%
Треть статей на arXiv теперь содержит «привкус ИИ»? Согласно недавнему исследованию unslop, за последний год 65% новых работ в области компьютерных наук были помечены детектором как потенциально созданные с помощью ИИ. Для сравнения, в математике этот показатель составил лишь 0,7%.
Исследование проанализировало 12750 статей на arXiv с января 2023 по июль 2026 года. До выхода ChatGPT в конце 2022 года уровень обнаружения был стабилен на уровне 0,4%. Однако вскоре после этого кривая резко пошла вверх, достигнув 32% в последнем полном квартале и пика около 39% в начале 2026 года.
Среди дисциплин компьютерные науки лидируют с 65%, за ними следуют количественная биология (56,3%), электротехника (51,3%) и экономика с финансами (47%). Крайне низкий показатель в математике (0,7%) исследователи объясняют ограничением своего детектора: он анализирует только текстовые паттерны, в то время как математические работы состоят в основном из формул, символов и стандартных фраз, что затрудняет анализ.
Важно отметить, что детектор фиксирует «степень похожести на текст ИИ», а не факт полного написания ИИ. Текст может быть просто отредактирован или стилистически соответствовать шаблонам, на которых обучались ИИ-модели. Более того, некоторые старые, «доИИевые» работы также могут быть помечены.
Использование ИИ для написания или редактирования научных текстов, особенно в конкурентных областях, становится всё более распространённым, превращаясь в своего рода «гонку вооружений». Это порождает новую форму скептицизма: даже качественный человеческий текст теперь может быть заподозрен в машинном происхождении, стирая традиционное доверие к письменному слову.
marsbit2 ч. назад