Треть arXiv оказалась под вопросом: 65% статей по CS пахнут «ИИ-привкусом», а математика — лишь 0,7%

marsbitОпубликовано 2026-07-27Обновлено 2026-07-27

Введение

Треть статей на arXiv теперь содержит «привкус ИИ»? Согласно недавнему исследованию unslop, за последний год 65% новых работ в области компьютерных наук были помечены детектором как потенциально созданные с помощью ИИ. Для сравнения, в математике этот показатель составил лишь 0,7%. Исследование проанализировало 12750 статей на arXiv с января 2023 по июль 2026 года. До выхода ChatGPT в конце 2022 года уровень обнаружения был стабилен на уровне 0,4%. Однако вскоре после этого кривая резко пошла вверх, достигнув 32% в последнем полном квартале и пика около 39% в начале 2026 года. Среди дисциплин компьютерные науки лидируют с 65%, за ними следуют количественная биология (56,3%), электротехника (51,3%) и экономика с финансами (47%). Крайне низкий показатель в математике (0,7%) исследователи объясняют ограничением своего детектора: он анализирует только текстовые паттерны, в то время как математические работы состоят в основном из формул, символов и стандартных фраз, что затрудняет анализ. Важно отметить, что детектор фиксирует «степень похожести на текст ИИ», а не факт полного написания ИИ. Текст может быть просто отредактирован или стилистически соответствовать шаблонам, на которых обучались ИИ-модели. Более того, некоторые старые, «доИИевые» работы также могут быть помечены. Использование ИИ для написания или редактирования научных текстов, особенно в конкурентных областях, становится всё более распространённым, превращаясь в своего рода «гонку вооружений». Это порождает нов...

Треть статей на arXiv, оказывается, написана ИИ?

Совсем недавно одно исследование от unslop взорвало иностранный интернет.

За последний год 65% новых статей в области компьютерных наук его детектор пометил красным.

Пользователи даже придумали для этого специальный термин — «эпоха Большого Помойного Ведра».

А вот математические статьи за тот же период — всего 0,7%.

Как зазвучал ChatGPT, кривая взлетела на месте

В этом исследовании команда проанализировала 12750 статей с arXiv, охватив период с января 2023 года по июль 2026.

Целью стали десять дисциплин, из каждой области ежемесячно выбиралось около 25 полных текстов.

Контрольную группу выбрали за 2021–2022 годы — эпоху до рождения ChatGPT, чисто человеческую.

Результаты показали, что в 2021–2022 годах уровень пометок стабильно держался на 0,4%; но с выпуском ChatGPT кривая за несколько месяцев взмыла вверх.

В последнем полном квартале уровень пометок достиг 32%, а в начале 2026 года пик и вовсе приблизился к 39%.

Если смотреть по дисциплинам, то компьютерные науки пострадали сильнее всего — уровень пометок достиг 65%.

А要知道 до появления ChatGPT базовый показатель здесь составлял лишь 0,2%. Всего за три года цифра взлетела более чем в 300 раз.

За ними следуют количественная биология — 56,3%, электротехника — 51,3%, экономика и финансы — 47%; далее идут прикладная физика — 34%, статистика — 31,3%, физика конденсированного состояния — 24%, физика высоких энергий — 14%, астрофизика — 10,7%.

В самой последней строке рейтинга — математика: 0,7%.

И это ещё только нижний предел. Если текст ИИ спрятан достаточно хорошо, детектор его не распознает.

Один и тот же детектор, одна и та же база статей, а разрыв приближается к 100 раз.

То ли математики коллективно придерживаются чисто ручного набора текста? То ли эта машина перед математическими формулами попросту слепа?

Упавшие на дно 0,7% — это слепота машины

На самом деле разгадку unslop уже собственноручно вписал в отчёт.

Подумайте, как выглядит стандартная математическая статья? Весь экран забит символами, формулами, теоремами и доказательствами, настоящих предложений на английском, написанных прозой, — раз-два и обчёлся.

А этот детектор распознаёт только текст. Он следит за структурой предложений, привычками словоупотребления, организацией абзацев.

А те несколько строк, что остались в математической статье, — сплошь «Пусть X будет таким-то», «Из леммы 3 следует» и прочие шаблонные выражения, которые в принципе не в том же регистре, что научный английский, на котором тренировали детектор.

Поэтому сама команда признаёт, что в нынешнем исследовании ещё немало ограничений:

0,7% по математике пока ни о чём не говорят. Возможно, математики действительно мало используют ИИ, а возможно, детектор не понимает математических статей, но эти данные не позволяют разграничить два варианта.

Контрольная группа тоже сравнительно мала. По каждой дисциплине всего 200 статей эпохи до ChatGPT, при уровне ложных срабатываний 0,4% из 2000 статей всего отмечено 8. Такие цифры можно считать лишь грубой оценкой.

И ещё, как уже говорилось, детектор выявляет не всё. Так что эти цифры — лишь нижний предел, реальная доля будет только выше.

Где больше конкуренции, тем больше нужен ИИ

Итак, кто же использует ИИ для написания статей?

Ответ кроется в другом двухлетнем исследовании Стэнфорда.

В марте 2024 года команда Вэйсиня Ляна из Стэнфорда впервые приложила измерительную линейку к рецензированию: в рецензиях ICLR 2024 около 10,6% предложений были существенно изменены с помощью LLM. Статьи ещё не проверили, а рецензенты сами уже начали ими пользоваться.

В августе 2025 года та же команда расширила выборку до 1,12 миллиона статей и напрямую вышла в «Nature Human Behaviour».

Исследование показывает, что по состоянию на сентябрь 2024 года доля изменений с помощью LLM в аннотациях статей по CS достигла максимума в 22,5%. И активнее всего ими пользовались исследователи, наиболее активно публикующие препринты и работающие в самых конкурентных областях.

Чем конкурентнее область, тем активнее используют.

Здесь написание с помощью ИИ уже стало гонкой вооружений: коллеги используют ИИ для ускорения темпа, и те, кто пишет только вручную, отстают на шаг.

Неудивительно, что в одном широко распространённом ретвите на X первая строка сопроводительного текста гласила: «Промпт: напиши статью, которую можно отправить на arXiv.»

Он улавливает «привкус», а не ИИ

Однако не спешите осуждать, опираясь на эти 65%.

Команда в отчёте также признаёт, что детектор не отличает «ИИ подправил грамматику» от «машина сделала всю работу», он лишь определяет концентрацию машинного привкуса в тексте.

Так что правильное понимание 65% — это «65% статей пахнут ИИ», а не «65% статей написаны ИИ».

Но проблема в том, что этим машинным привкусом могут заразиться и сами люди.

Был один скептически настроенный исследователь, который закинул в детектор свои старые статьи, написанные много лет назад, и в результате от 27% до 74% содержания было помечено красным.

А要知道 в ту эпоху ChatGPT и в помине не было.

Причина нетрудно найти.

Откройте современный научный журнал — страницы заполнены большими языковыми моделями, бенчмарками, передовыми отраслевыми разработками. Чем стандартнее формулировки, чем строже структура, тем легче нарваться на машинные признаки, которые определяет детектор.

К тому же LLM изначально обучались на таких статьях. Не учёные пишут, как ИИ, а ИИ изначально пишет, как учёные.

Когда все тексты становятся подозрительными

На самом деле последние два года мы все занимаемся тем же, что и детектор.

Читаешь ровный, аккуратный, местами с «не только..., но и...» текст — и сердце ёкает: это, наверное, ИИ написал?

Детектор unslop превратил это смутное чутьё в прибор, способный производить цифры.

Ведь раз сомнение поселилось в голове, от него уже не избавиться.

Раньше сам факт «написания» уже был своего рода гарантией. Человек, готовый потратить несколько часов на организацию текста, по крайней мере, демонстрировал серьёзность.

Теперь, как бы красиво ни написали, можно получить лишь ответ: «ИИ, да?».

Некоторые даже начали намеренно избегать слов, которыми пользовались полжизни, только потому, что они «звучат слишком по-ИИшному».

Сегодня «ИИ-привкус» превращается в новый вид первородного греха, охватившего мир текста.

Комично то, что до сих пор мы даже не можем точно измерить, из чего состоит этот самый «ИИ-привкус».

Эта статья из официального аккаунта WeChat «Новый Эон Разума», автор: ASI Апокалипсис

Трендовые криптовалюты

Связанные с этим вопросы

QКакой процент новых статей в области компьютерных наук был помечен детектором AI в исследовании?

AВ исследовании было отмечено, что 65% новых статей в области компьютерных наук были помечены детектором как имеющие признаки написания с помощью ИИ.

QКак изменился процент помеченных статей в arXiv после выпуска ChatGPT?

AПосле выпуска ChatGPT процент статей в arXiv, помеченных детектором, резко вырос. Если в 2021-2022 годах он составлял около 0.4%, то к началу 2026 года достиг пика около 39%, а в последнем полном квартале исследования составил 32%.

QВ какой научной области был зафиксирован самый низкий процент статей, помеченных как написанные ИИ, и с чем это может быть связано?

AСамый низкий процент (0.7%) был зафиксирован в области математики. Авторы исследования предполагают, что это может быть связано как с меньшим использованием ИИ математиками, так и с ограничениями самого детектора, который анализирует только текст и плохо справляется с математическими работами, состоящими в основном из формул, символов и стандартных фраз.

QЧто, согласно статье, означает показатель в 65% для статей по компьютерным наукам?

AПоказатель в 65% означает, что 65% статей по компьютерным наукам, по мнению детектора, обладают стилистическими признаками («привкусом»), характерными для текстов, сгенерированных ИИ. Это не обязательно означает, что эти статьи целиком написаны ИИ; показатель может отражать как частичное использование ИИ для редактирования, так и естественное сходство академического стиля с тренировочными данными ИИ.

QКак, согласно статье, использование ИИ в написании научных работ связано с конкуренцией в научной среде?

AСогласно исследованию Стэнфордского университета, упомянутому в статье, наиболее активно ИИ для написания и редактирования работ используют исследователи в самых конкурентных и быстро развивающихся областях (например, в компьютерных науках). Это стало своего рода «гонкой вооружений»: если коллеги используют ИИ для ускорения работы, то те, кто пишут вручную, могут отставать по темпам.

Похожее

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

Источник: интервью Рэя Далио, основателя Bridgewater Associates, для подкаста "The Diary Of A CEO". Далио, предсказавший кризис 2008 года, обсуждает "большой цикл" — концепцию, охватывающую долговые проблемы, растущее неравенство и геополитические сдвиги. Он указывает, что текущий ажиотаж вокруг ИИ демонстрирует классические признаки пузыря, который может лопнуть из-за высокой долговой нагрузки, роста процентных ставок и чрезмерной эмиссии акций, что способно привести к рецессии. Для защиты личного капитала в неопределенные времена Далио советует диверсификацию: вместо хранения наличных инвестировать в акции, золото, облигации. Сам он держит около 1% портфеля в биткоине, считая его "твердыми деньгами", но предпочитает физическое золото из-за его статуса резервного актива и независимости от технологических рисков. Говоря о влиянии ИИ, Далио отмечает, что технология заменяет не только физический труд, но и элементы мышления, что увеличит разрыв между капиталом и трудом. Ключевыми останутся человеческие качества — эмоции и интуиция, а успеха добьются те, кто научится работать в партнерстве с ИИ. На геополитической арене, по его мнению, мир движется к регионализации с центрами в виде США и Китая. Вовлечение США в конфликты, подобные иранскому, обнажает снижение их абсолютного влияния. Внутренние вызовы, такие как дебаты о налогах на богатство, риск капитального бегства и низкая производительность, также ставят под вопрос стабильность традиционных держав в текущей фазе цикла.

marsbit1 ч. назад

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

marsbit1 ч. назад

7.2 трлн вон за один день: иностранные инвесторы установили рекорд чистых покупок в пятницу! Уолл-Стрит: встречный ветер в плане ликвидности на южнокорейском рынке уже утих

Капиталы возвращаются на южнокорейский рынок акций. 31 июля иностранные инвесторы осуществили чистые покупки акций KOSPI на рекордные 7,2 трлн вон за один день, что стало самым высоким показателем в истории. По данным Citigroup, эта цифра знаменует собой кардинальный разворот после месяцев масштабного оттока средств нерезидентов. В июле чистые продажи иностранными инвесторами значительно сократились до 9,8 трлн вон по сравнению с 48,4 трлн и 44,5 трлн вон в июне и мае соответственно. Одновременно внутренние пенсионные и инвестиционные фонды в июле вернулись к чистым покупкам на 1,0 трлн вон. Дополнительным фактором снижения волатильности стали новые правила Комиссии по финансовым услугам (FSC), ужесточившие с 31 июля доступ розничных инвесторов к ETF с плечом на отдельные акции. После введения норм торговый оборот таких инструментов упал примерно вдвое. Citigroup сохраняет целевую точку для KOSPI на уровне 10000 пунктов, отмечая ослабление давления со стороны движения капиталов. Аналитики видят поддержку рынку в устойчивости фундаментальных показателей сектора чипов памяти, низких оценках KOSPI, сильной экономике и благоприятной политике властей, включая возможные меры по поддержке ликвидности.

marsbit1 ч. назад

7.2 трлн вон за один день: иностранные инвесторы установили рекорд чистых покупок в пятницу! Уолл-Стрит: встречный ветер в плане ликвидности на южнокорейском рынке уже утих

marsbit1 ч. назад

Как стать человеком, которого искусственный интеллект никогда не сможет заменить

В статье рассматривается вопрос о том, как остаться незаменимым в эпоху искусственного интеллекта. Автор утверждает, что вместо страха перед ИИ следует сосредоточиться на развитии качеств, которые машины не смогут заменить. Он критикует «зарплатное рабство» — зависимость от работы, не приносящей удовлетворения, и предлагает путь к финансовой независимости через создание собственного дела. Ключ к успеху — развитие пяти элементов: самостоятельности (агентности), вкуса, умения убеждать, упорства и способности к итерациям. Главное — не просто создавать что-либо (сегодня это может каждый), а создавать что-то ценное, востребованное и уметь это продвигать. Автор считает, что наиболее важным навыком будущего является создание контента (медиа), а не просто написание кода, поскольку ценность контента субъективна и требует уникального человеческого вкуса и суждения. ИИ может помочь в производстве, но не заменит оригинальность мысли и связь с аудиторией. В качестве практического шага предлагается упражнение: за 15 минут ответить на вопросы, чтобы обнаружить свои уникальные знания, опыт и точку зрения, которые станут основой для личного бренда и дела жизни. Первый шаг — немедленно опубликовать свою основную идею, чтобы получить обратную связь от реального мира и начать процесс роста. Цель — стать «непригодным для найма», построив жизнь вокруг собственного творчества и экспертизы.

marsbit3 ч. назад

Как стать человеком, которого искусственный интеллект никогда не сможет заменить

marsbit3 ч. назад

Благодаря броскам кубиков ключи от биткоинов хранятся в автономном режиме, но не все будут этим заниматься

Статья посвящена практике генерации сид-фраз для биткоин-кошельков с помощью бросков кубиков в свете уязвимости, обнаруженной в аппаратных кошельках Coldcard. Подчеркивается, что физический бросок кубика (дающий около 2.6 бит энтропии за бросок) создает высококачественную случайность, поскольку предсказать результат практически невозможно из-за множества переменных. Для создания стандартной сид-фразы из 12 слов (128 бит энтропии) требуется около 50 бросков, а для повышенной безопасности рекомендуется 99 и более. В связи с инцидентом Coldcard, когда неисправный генератор случайных чисел в прошивке (2021-2026 гг.) мог создавать предсказуемые ключи, выяснилось, что сид-фразы, сгенерированные вручную через кубики, были защищены от этой уязвимости. Однако исследование показало, что другие функции устройства (создание бумажных кошельков, ключей для мультиподписи, паролей и т.д.) по-прежнему использовали скомпрометированный генератор, подвергая риску владельцев даже с безопасной основной сид-фразой. Автор отмечает, что, хотя метод с кубиками криптографически надежен, он непрактичен для массового использования из-за трудоемкости, высокой вероятности ошибок при вводе и необходимости строгой дисциплины для сохранения секретности процесса. Делается вывод, что будущее безопасности лежит в создании надежных аппаратных генераторов случайных чисел и понятных интерфейсов, а ручные методы остаются нишевым инструментом для опытных пользователей. Владельцам Coldcard рекомендуется обновить прошивку и проверить/заменить все ключи, сгенерированные уязвимыми функциями.

cryptonews.ru6 ч. назад

Благодаря броскам кубиков ключи от биткоинов хранятся в автономном режиме, но не все будут этим заниматься

cryptonews.ru6 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片