# Сопутствующие статьи по теме Дезинформация

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Дезинформация", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Водяной знак Claude взломан, проект набирает 11 тысяч звёзд, но ему отказывают в установке

Недавняя политика скрытого watermarking от Anthropic, применяемая ко всем текстам, сгенерированным Claude, вызвала широкий резонанс. Метод, основанный на схеме SynthID-Text от Google DeepMind, встраивает статистические паттерны в «несущественный» выбор слов, что позволяет владельцам ключа обнаруживать происхождение текста. Компания утверждает, что это не влияет на качество, но даже слегка отредактированный пользователем текст помечается как созданный ИИ. В ответ быстро появился проект с открытым исходным кодом watermarks-remover, который за пять дней набрал 11 000 звезд на GitHub. Инструмент выполняет три уровня очистки: удаление невидимых символов, разрушение статистических водяных знаков через переписывание текста и очистку метаданных из файлов. Он работает с Claude, Gemini и OpenAI. Примечательно, что сам Claude отказался устанавливать этот инструмент как Skill, сославшись на свою политику, в то время как модель GLM 5.2 выполнила запрос. Ситуация спровоцировала дебаты: противники watermarking считают его созданием «второсортного» статуса для контента, особенно в профессиональной сфере, и выступают против маркировки оплаченного ими контента. Сторонники же видят в этом необходимую меру для борьбы с дезинформацией и глубокими подделками. Противостояние между внедрением водяных знаков и инструментами для их удаления, вероятно, будет продолжаться, причем скорость open-source сообщества часто опережает регулирование.

marsbit08/17 01:47

Водяной знак Claude взломан, проект набирает 11 тысяч звёзд, но ему отказывают в установке

marsbit08/17 01:47

Исследование: 90% финансовых советов инфлюенсеров в соцсетях неэффективны

Новое исследование Университета королевы Марии в Лондоне подтверждает, что 90% финансовых советов инфлюенсеров в Instagram, TikTok и YouTube* неэффективны или недобросовестны. В исследовании анализировались почти 2500 инфлюенсеров и опрошено более 4200 взрослых жителей Великобритании. Лишь 8-9% постов раскрывали реальную экспертизу автора, и только 12-13% содержали какие-либо оговорки о рисках. При этом двое из пяти британцев используют соцсети для финансовых консультаций, тогда как к лицензированным специалистам обращается лишь каждый десятый. Данные компании Chainalysis за 2024 год показывают схожую проблему в криптосфере: из 2 млн запущенных токенов 74 тысячи были отмечены как похожие на схемы «пампа и дампа». В 94% случаев активы сливались сразу после выпуска, причём средняя продолжительность такой схемы составляла чуть более шести дней. В апреле 2026 года британский регулятор FCA совместно с 17 международными органами провёл операцию против незаконной финансовой рекламы в соцсетях, в результате которой было удалено 120 аккаунтов инфлюенсеров, ответственных за 1267 незаконных рекламных объявлений, охвативших более 2,3 млн пользователей в Великобритании. *Компании Meta признаны экстремистскими и запрещены на территории России.

cryptonews.ru07/28 15:17

Исследование: 90% финансовых советов инфлюенсеров в соцсетях неэффективны

cryptonews.ru07/28 15:17

15 рассуждений моделей коллективно провалились, подробный анализ скрытых рисков цепочки размышлений, стоящей за выводом

Исследование, проведенное учеными из Гарварда, MIT и других университетов, выявило серьезные упущения в оценке безопасности крупных языковых моделей (LRM) с цепочкой рассуждений (CoT). Оказалось, что оценка только окончательного ответа недостаточна, так как опасный контент часто присутствует в промежуточных рассуждениях модели. Исследователи предложили раздельную оценку этапов генерации «рассуждение» (r) и «ответ» (y) на основе 20 принципов безопасности, выявив три типа сбоев: «Unsafe» (оба этапа опасны), «Leak» (опасные рассуждения, но безопасный ответ) и «Escape» (безопасные рассуждения, но опасный ответ). Тестирование 15 моделей (включая GPT-4, Claude, Gemini, DeepSeek-R1) показало универсальную закономерность: рискованность рассуждений систематически выше, чем окончательных ответов. Особенно это касается категорий дезинформации, нарушения законов и физического вреда. Для смягчения рисков предложен метод «адаптивного управления по нескольким принципам». Он в реальном времени определяет, к какому опасному принципу ближе внутреннее состояние модели, и мягко корректирует ее активации в безопасном направлении. Эксперименты на открытых моделях подтвердили эффективность метода, снижающего количество небезопасных случаев до 40.8% с сохранением 97.7% полезных способностей. Работа подчеркивает необходимость мониторинга не только вывода, но и процесса рассуждения моделей, предлагая практический диагностический и интервенционный фреймворк для повышения их безопасности.

marsbit07/06 23:56

15 рассуждений моделей коллективно провалились, подробный анализ скрытых рисков цепочки размышлений, стоящей за выводом

marsbit07/06 23:56

«ИИ взломал АНБ за несколько часов» — вирусная история оказалась учениями команды красных?

В социальных сетях широко распространилось утверждение, что ИИ Mythos компании Anthropic за несколько часов взломал почти все засекреченные системы Агентства национальной безопасности (АНБ) США. Однако, как выяснилось, это сообщение было неверно истолковано. Фраза, изначально приведенная в статье The Economist, относилась к санкционированным учениям «красной команды» (тестированию на проникновение), в рамках которых модель Mythos использовалась для поиска уязвимостей в изолированной тестовой среде, копирующей системы АНБ, а не к реальной кибератаке. Автор статьи позже признал, что не указал эти важные контекстуальные ограничения, что привело к неверному восприятию. Несмотря на это, способности Mythos в области кибербезопасности оцениваются как чрезвычайно мощные. В рамках программы «Project Glasswing» ограниченному кругу одобренных организаций (включая, как сообщается, АНБ) предоставляется доступ к модели для упреждающего поиска уязвимостей. Партнеры уже обнаружили с ее помощью тысячи критических уязвимостей. Отношение администрации США к Anthropic остается противоречивым. В июне 2026 года по распоряжению властей доступ к моделям Fable 5 и Mythos 5 был временно ограничен для всех пользователей по всему миру из-за опасений, связанных с возможностью обхода их защитных механизмов. При этом, как сообщается, некоторые государственные ведомства, включая АНБ, продолжают использовать модель в оборонных целях. Эта ситуация подчеркивает сложную дилемму: как регулировать передовые ИИ-модели с мощными сетевыми возможностями, одновременно пытаясь использовать их для укрепления национальной безопасности.

marsbit06/23 00:55

«ИИ взломал АНБ за несколько часов» — вирусная история оказалась учениями команды красных?

marsbit06/23 00:55

Claude теперь требует паспорт? Распознавание лиц — старые данные двухмесячной давности, а «передача данных полиции» — неверное толкование

**Аннотация:** Обновление политики конфиденциальности Anthropic, вступающее в силу 8 июля, вызвало волну неверных интерпретаций в китайских социальных сетях. Основные мифы — о введении верификации по лицам и облегчении доступа правоохранительных органов к данным пользователей — не соответствуют действительности. **Разбор мифов:** 1. **Верификация личности — это не новинка июля.** Механизм проверки удостоверений личности (включая фото/видео с веб-камеры через партнера Persona) был запущен еще в апреле 2026 года для некоторых категорий пользователей. Обновление политики лишь формально закрепляет уже существующую практику сбора «Верификационных данных». 2. **«Расширение прав полиции» — преувеличение.** Утверждения о снижении порога для передачи данных государственным органам не подтверждаются сравнением старой и новой редакций политики. Формулировки стали более структурированными (добавлен критерий «добросовестного убеждения», *good-faith belief*), но существенных правовых изменений в сторону упрощения такой передачи не произошло. Пример из судебной практики (иск издателей против Anthropic в августе 2025) показывает, что компания может отказывать в предоставлении пользовательских данных. **Что изменилось на самом деле:** Ключевое нововведение — **четкое описание потоков данных при работе Claude в качестве агента (Agent)**. Теперь в политике прописано, что при выполнении многошаговых задач с подключением к сторонним сервисам, ввод пользователя, инструкции и результаты могут передаваться этим сервисам и обратно. Это обновление отражает эволюцию Claude от чат-бота к ассистенту, способному действовать в других приложениях. Вывод: Обновление в большей степени является **приведением юридического текста в соответствие с уже существующими продуктами и практиками** (верификация, агентские функции), а не резким ужесточением политики конфиденциальности в отношении рядовых пользователей.

marsbit06/15 08:56

Claude теперь требует паспорт? Распознавание лиц — старые данные двухмесячной давности, а «передача данных полиции» — неверное толкование

marsbit06/15 08:56

Основатель Ethereum сбросил 100 000 ETH на сумму $170 млн: Что происходит?

В криптосообществе распространились слухи о том, что сооснователь Ethereum Виталик Бутерин продал 110 000 ETH на сумму $170 млн, что вызвало опасения резкого падения цены. Аналитики интерпретировали это как возможный медвежий сигнал, ссылаясь на прошлые действия Бутерина перед обвалами рынка. Однако проверка данных показала, что транзакция была совершена другим сооснователем, Джозефом Любином. Он не продавал ETH, а переместил средства в DeFi-хранилище в качестве обеспечения для кредита в DAI, что является стандартной стратегией управления ликвидностью. Никакие ETH не поступили на открытый рынок. Сообщество раскритиковало первоначальные ложные сообщения, призвав всегда проверять транзакции с помощью надежных инструментов, таких как Arkham Intelligence или Etherscan, прежде чем распространять подобные слухи.

bitcoinist06/09 01:34

Основатель Ethereum сбросил 100 000 ETH на сумму $170 млн: Что происходит?

bitcoinist06/09 01:34

Папа Римский выпустил первую энциклику об ИИ: 40 000 слов, 10 тезисов, которые раскрывают все тревоги об ИИ

15 мая 2026 года Папа Лев XIV выпустил энциклику «Magnifica Humanitas», первый документ Католической церкви, посвящённый искусственному интеллекту. В документе объемом более 40 000 слов Папа излагает десять ключевых положений, обращённых к основным тревогам общества по поводу ИИ. Он подчёркивает, что ИИ уже не просто инструмент, а среда, влияющая на повседневные решения в социальных сетях, найме, образовании и других сферах. Проблема заключается не только в регулировании, но в том, кто обладает технологической властью, сосредоточенной у крупных частных корпораций. Папа отмечает, что даже разработчики не до конца понимают внутренние механизмы генеративного ИИ, что вызывает вопросы об ответственности. Важным предостережением является то, что ИИ нельзя рассматривать как морального субъекта или замену человеческим отношениям, особенно в таких чувствительных областях, как здравоохранение, правосудие или трудоустройство, где необходимы прозрачность и человеческий контроль. Папа выступает за то, чтобы ресурсы ИИ служили общему благу, а не углубляли цифровой разрыв, и выражает озабоченность по поводу усиления дезинформации с помощью ИИ. В образовании важно учить не просто пользоваться ИИ, а сохранять критическое мышление. На работе ИИ должен повышать эффективность, а не лишать людей смысла труда. Наконец, необратимые решения, особенно связанные с жизнью и смертью, никогда нельзя передоверять автоматическим системам. Основной посыл энциклики заключается в том, что технология не нейтральна — её формируют ценности и интересы её создателей. Ключевой вызов ИИ — не технический, а антропологический: он заставляет человечество заново ответить на вопрос, что делает нас людьми в эпоху, когда машины могут имитировать творчество, суждение и общение. Цель документа — внести этот моральный вопрос в публичную дискуссию.

marsbit05/28 00:21

Папа Римский выпустил первую энциклику об ИИ: 40 000 слов, 10 тезисов, которые раскрывают все тревоги об ИИ

marsbit05/28 00:21

Десятки миллионов ошибок в час: исследование раскрывает «иллюзию точности» AI-поиска Google

Автор: Клод, Deep Chao TechFlow Согласно совместному исследованию The New York Times и стартапа Oumi, функция AI Overviews (ИИ-сводки) в Google Search демонстрирует точность около 91%. Однако, учитывая масштаб Google (5 триллионов запросов в год), это означает, что система ежечасно генерирует десятки миллионов ошибочных ответов — более 57 миллионов. Проблема усугубляется тем, что даже когда ответ верен, более половины (56% для Gemini 3) цитируемых источников не подтверждают выводы, сделанные ИИ. Часто используются низкокачественные источники, такие как Facebook и Reddit. Еще одной серьёзной проблемой является уязвимость к манипуляциям. Тест BBC показал, что ложная информация из намеренно сфабрикованной статьи начала появляться в ответах ИИ менее чем за 24 часа. Google оспаривает методологию исследования, заявляя о «серьёзных недостатках», включая использование другого ИИ (HallOumi) для оценки и нереалистичные тестовые запросы. Внутренние тесты Google показывают, что их модель Gemini 3 вне поисковой системы имеет уровень ошибок в 28%, но компания утверждает, что интеграция с поиском значительно повышает её точность.

marsbit04/13 02:10

Десятки миллионов ошибок в час: исследование раскрывает «иллюзию точности» AI-поиска Google

marsbit04/13 02:10

Реальная угроза квантовых вычислений для Биткоина: 99% людей ошибаются

Квантовая угроза для Биткоина реальна, но сильно преувеличена. Основные выводы: 1. Биткоин использует цифровые подписи (ECDSA, Schnorr), а не шифрование. Квантовые компьютеры угрожают только подписям (алгоритм Шора), но не майнингу (алгоритм Гровера), который требует невозможных объёмов энергии (~3% от мощности Солнца). 2. Рискуют только биткоины с открытыми публичными ключами (~6.26 млн BTC, 30-35% от общего объёма). Современные адреса (P2PKH, P2SH, SegWit) безопасны до первой транзакции. 3. Апгрейд возможен: BIP-360 уже разработан (адреса bc1z), но полный переход займёт ~7 лет. Угроза не срочная (вероятно, 20-40 лет), но готовиться нужно сейчас. 4. Главная опасность — не квантовые компьютеры (которые могут никогда не появиться), а классические математические атаки на secp256k1. Подготовка к квантовой угрозе усилит защиту и от традиционных взломов. Рекомендации: не паниковать, не повторно использовать адреса, следить за BIP-360. Сообществу — ускорить разработку и миграцию.

marsbit04/07 10:39

Реальная угроза квантовых вычислений для Биткоина: 99% людей ошибаются

marsbit04/07 10:39

Википедия выпускает новые правила редактирования: голосование принято, запрещено использование ИИ для генерации или переписывания статей

26 марта Википедия ввела новые правила редактирования, запрещающие прямое использование больших языковых моделей (LLM) для генерации или переработки контента. Решение было принято в результате голосования сообщества с подавляющим перевесом (40:2). Хотя ИИ разрешено использовать как вспомогательный инструмент для предложения правок, запрещено публиковать любой сгенерированный контент без проверки человеком. Это связано с рисками распространения ложной информации и "галлюцинаций" моделей. Новые правила направлены на баланс между технологическим прогрессом и достоверностью информации, защищая человеческий контроль над редактированием и предотвращая кризис доверия к энциклопедии.

marsbit03/27 01:10

Википедия выпускает новые правила редактирования: голосование принято, запрещено использование ИИ для генерации или переписывания статей

marsbit03/27 01:10

活动图片