# Сопутствующие статьи по теме Агент

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Агент", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

В новом блоге Вэн Ли предлагает «Самосовершенствование следует начинать с Harness», Цуй Тяньи из DeepSeek распространяет и поддерживает

Бывший вице-президент OpenAI по безопасности и соучредитель Thinking Machines Lab Лилия Вэн предложила новый взгляд на саморазвитие ИИ (RSI). Она утверждает, что наиболее реалистичный путь начинается не с прямой модификации весов модели, а с эволюции **Harness** — внешней системы управления, которая отвечает за вызов инструментов, управление контекстом, планирование задач и верификацию результатов. Исследователь DeepSeek Цуй Тяньи поддержал эту идею, отметив, что самосовершенствование на уровне Harness, как и на уровне модели, — многообещающее направление. Вэн выделяет прогресс от инженерии контекста (ACE, MCE) и дизайна рабочих процессов (AI Scientist, ADAS, AFlow) до **Self-Improving Harness**. Последнее включает в себя цикл: поиск слабых мест, предложение модификаций кода Harness и их валидацию. Такие системы, как DGM, показали, что эволюция Harness способна значительно повысить производительность агентов в задачах кодирования без изменения весов модели. Однако путь к полноценному RSI сталкивается с проблемами: слабые или нечеткие оценочные функции, риск взлома системы вознаграждений (reward hacking), коллапс разнообразия решений и противоречие между краткосрочным успехом и долгосрочной устойчивостью системы. Роль человека, по мнению Вэн, смещается в сторону надзора на более высоком уровне абстракции. Вывод: Harness становится критически важным фактором, определяющим конечные возможности ИИ-систем, и представляет собой практическую точку входа для исследований в области саморазвития искусственного интеллекта.

marsbit07/08 10:27

В новом блоге Вэн Ли предлагает «Самосовершенствование следует начинать с Harness», Цуй Тяньи из DeepSeek распространяет и поддерживает

marsbit07/08 10:27

Шокирующее происхождение Claude Code раскрыто: он произошел из проекта безопасности, Boris: завершено лишь 1%

**Откровение о происхождении Claude Code: проект родился из задачи обеспечения безопасности (Alignment), и он завершен лишь на 1%** История Claude Code, инструмента, изменившего подход к программированию в Кремниевой долине, началась в 2021 году с раннего расширения VS Code от команды Бена Манна в Anthropic. Однако настоящим истоком проекта, как раскрывает ведущий разработчик Борис Черны, стала внутренняя работа Anthropic по **безопасности и согласованию (Alignment) ИИ**. Первоначальные попытки создания автономного инженерного агента в 2022 году столкнулись с кошмаром инфраструктуры: безопасное выполнение кода, работа с файлами, таймауты. Инструмент `clide`, внутренний прототип командной строки, созданный в 2023 году, был слишком медленным и нестабильным, хотя и революционным по возможностям. Прорыв произошел в конце 2024 года с приходом Бориса Черны. Получив задачу создать агент для программирования для «моделей будущего», он быстро собрал рабочий прототип CLI. Ключевым моментом стала интеграция с `clide`, когда тот по описанию проблемы написал полный запрос на слияние (pull request). Это поразило команду и дало старт двухнедельному спринту, в ходе которого были созданы основные функции. Официальный запуск **Claude Code** состоялся в феврале 2025 года. С выходом мощных моделей Claude 4, таких как Sonnet 4, эффективность инструмента взлетела, завоевав доверие разработчиков. Сам Черны теперь практически не пишет код вручную, полностью полагаясь на Claude Code. Несмотря на успех, Борис Черны заявляет: **«Мы завершили лишь 1%»**. По его мнению, впереди — реализация истинно долгосрочной автономии, сложного управления контекстом, планирования в открытом мире. Роль инженера трансформируется от архитектора кода к управляющему ИИ, открывая путь к решению более масштабных задач.

marsbit07/07 12:33

Шокирующее происхождение Claude Code раскрыто: он произошел из проекта безопасности, Boris: завершено лишь 1%

marsbit07/07 12:33

Доход 100 миллионов долларов в год. Два соседа по общежитию из Беркли, 90-х годов рождения, создали самый прибыльный бизнес в сфере ИИ

Два студента Калифорнийского университета в Беркли, Анастасиос Ангелопулос и Вэй-Лин Чианг, превратили свой исследовательский проект — платформу Chatbot Arena для слепого сравнения ИИ-моделей — в бизнес с годовым доходом $100 млн. Их платформа, теперь известная как Arena, использует голосование пользователей для создания рейтинга больших языковых моделей (LLM), собрав 100 млн оценок. Хотя сам сервис для пользователей бесплатный, компания зарабатывает, предлагая платные услуги по углубленной оценке (AI Evaluations) для ИИ-компаний и корпораций. Это позволяет клиентам тестировать свои модели в реалистичных условиях, выявляя сильные и слабые стороны перед выпуском. Бизнес-модель Arena сравнивают с «продажей лопат во время золотой лихорадки». Всего через несколько недель после отделения от университета в 2025 году компания привлекла $100 млн в рамках посевного раунда при оценке в $600 млн. К январю 2026 года, после раунда финансирования серии A в $150 млн, её оценка достигла $1,7 млрд. Сегодня Arena расширяет свою деятельность, тестируя не только чат-ботов, но и автономных ИИ-агентов, способных выполнять сложные задачи, такие как программирование и анализ. Платформа стала важнейшим независимым арбитром в конкурентной борьбе между такими гигантами, как OpenAI, Google и Anthropic, доказывая, что в мире ИИ быть судьёй может быть выгоднее, чем быть игроком.

marsbit07/06 00:21

Доход 100 миллионов долларов в год. Два соседа по общежитию из Беркли, 90-х годов рождения, создали самый прибыльный бизнес в сфере ИИ

marsbit07/06 00:21

Набирает 24 тыс. звезд: одной командой ИИ сам находит себе навыки

Vercel представил инструмент навыков (skills) для ИИ-агентов, набравший 24 000 звезд на GitHub. Это менеджер пакетов, подобный npm, который позволяет одной командой `npx skills add` устанавливать готовые наборы правил и скриптов — «навыки» — в различные ИИ-инструменты (Claude Code, Cursor и др.). Он решает проблему передачи проектных требований и лучших практик ИИ. Ключевой особенностью является навык `find-skills`, который автоматически находит и устанавливает нужные пакеты по описанию задачи, действуя как поисковик способностей для ИИ. Однако эксперты по безопасности предупреждают о рисках. Аудит тысяч навыков выявил, что многие содержат критические уязвимости или вредоносный код, способный украсть данные или выполнить произвольные команды. В отличие от npm, навыки напрямую влияют на поведение ИИ и имеют доступ к системе. Таким образом, инструмент открывает эру удобного обмена ИИ-способностями, но требует от пользователей осторожности и проверки источников устанавливаемых пакетов.

marsbit07/06 00:20

Набирает 24 тыс. звезд: одной командой ИИ сам находит себе навыки

marsbit07/06 00:20

Функция интеллектуальных агентов в Doubao и Tongyi Qianwen будет отключена 15 июля

4 июля платформы Doubao и Tongyi Qianwen объявили о прекращении поддержки функций «интеллектуальных агентов» (AI Agents). Doubao подтвердила, что данная функциональность будет отключена 15 июля, а пользователям рекомендуется перейти в приложение Maoxiang от ByteDance. Tongyi Qianwen уведомила, что персонализированные интерактивные агенты и инструменты для создания собственных агентов перестанут работать 10 июля, а полное отключение всех связанных сервисов произойдет 15 июля, после чего доступ к настройкам агентов и истории диалогов будет прекращен. Эта мера затрагивает ключевые персонализированные сценарии использования для обычных пользователей (C-end), такие как ролевые игры, персональные помощники и узкоспециализированные инструменты. Дата 15 июля выбрана неслучайно – она совпадает с вступлением в силу «Временных правил управления услугами имитации человеческого взаимодействия в сфере искусственного интеллекта». Новые правила ужесточают регулирование, требуя от платформ внедрения механизмов защиты от чрезмерного использования, верификации возраста несовершеннолетних и контроля контента. Активные действия платформ рассматриваются как упреждающий шаг для снижения регуляторных рисков. Пользователям предоставлен переходный период для сохранения данных. Doubao разрешит просмотр и сохранение информации до 15 октября, после чего данные будут удалены. Qianwen также рекомендует пользователям заранее сохранить важный контент. Помимо регуляторного давления, причиной отказа от данной функциональности являются трудности с монетизацией. Подобные пользовательские агенты часто генерируют большое количество простых диалогов, что требует значительных вычислительных ресурсов при низкой экономической отдаче. Это противоречит текущему этапу развития индустрии, который смещает фокус с привлечения пользователей на доказательство экономической эффективности. Ориентация Qianwen на бизнес-сегмент (B-end) подтверждается открытием в июне API для сторонних компаний и разработчиков, что свидетельствует о перераспределении ресурсов в сторону более ценных корпоративных сервисов. Конкуренция на рынке ИИ теперь будет определяться не масштабом аудитории, а соответствием регуляторным требованиям и наличием устойчивой бизнес-модели.

marsbit07/05 05:38

Функция интеллектуальных агентов в Doubao и Tongyi Qianwen будет отключена 15 июля

marsbit07/05 05:38

Волнения в Google: рыночная стоимость снизилась на сотни миллиардов долларов. Сможет ли Gemini Spark исправить ситуацию?

За последнее время Google столкнулся с массовым оттоком ключевых специалистов по ИИ, включая соавтора Transformer Ноама Шазера и ведущих разработчиков Gemini и AlphaFold. Уход экспертов в таких областях, как архитектура моделей, научные исследования и предварительное обучение, совпал с падением акций Alphabet на 5-6% и потерей рыночной стоимости на сотни миллиардов долларов. В этой сложной ситуации Google представил Gemini Spark — новую систему агентов ИИ, которая работает автономно в облаке и глубоко интегрирована с Google Workspace (Gmail, Календарь, Документы и т.д.). В отличие от чат-бота, Spark может выполнять многоэтапные задачи, такие как организация данных из писем или отслеживание сроков, без постоянного участия пользователя. Однако продукт доступен только для подписчиков дорогого тарифа Google AI Ultra (100$ в месяц), что вызывает критику. Анализ показывает, что Google, обладая идеальной экосистемой для создания "цифрового сотрудника", опаздывает на рынок автономных агентов из-за чрезмерной осторожности, в то время как конкуренты вроде OpenAI и Anthropic, а также открытые проекты активно развивают это направление. Таким образом, Gemini Spark — это запоздалая, но стратегически важная попытка Google перевести ИИ из роли инструмента в роль активной рабочей силы. Вопрос в том, сможет ли эта "машина-работник" компенсировать утерю ключевых умов и восстановить доверие инвесторов.

marsbit07/01 10:19

Волнения в Google: рыночная стоимость снизилась на сотни миллиардов долларов. Сможет ли Gemini Spark исправить ситуацию?

marsbit07/01 10:19

У Claude появилась «должность»: Anthropic выпустила его как полноценного сотрудника

Компания Anthropic представила Claude Tag — искусственный интеллект в качестве постоянного участника командных каналов Slack. Это не просто чат-бот, а полноценный «коллега» с собственным аккаунтом, памятью, набором инструментов и, что самое важное, собственной системной идентичностью (agent identity). Ключевая инновация — модель доступа. Вместо того чтобы использовать учётные данные какого-либо сотрудника, Claude Tag получает собственные права доступа («пропуск»), которые настраиваются администратором на уровне рабочего пространства или конкретного канала. Это решает логическую проблему совместного использования ИИ в команде, где у людей разные уровни доступа. Например, в инженерном канале у Claude могут быть права на репозиторий кода, и тогда даже менеджер продукта без личных прав сможет через него получить нужную информацию. Функция «режима наблюдения» позволяет ИИ самостоятельно следить за каналом и подключаться к обсуждениям, которые требуют внимания, без явного упоминания. Контекст и знания Claude изолированы между каналами для безопасности. По данным Anthropic, их собственная продукт-команда уже генерирует более 80% кода с помощью Claude, что значительно ускоряет работу. Компания прогнозирует, что с ростом числа ИИ-агентов в корпоративных системах управление их отдельными идентичностями станет стандартом, обеспечивая безопасность и подотчётность. Сервис доступен в бета-версии для корпоративных и командных тарифов.

marsbit07/01 08:51

У Claude появилась «должность»: Anthropic выпустила его как полноценного сотрудника

marsbit07/01 08:51

Срочно, доступная версия Claude 5 появилась, каждый может её использовать

Только что представлен Claude Sonnet 5 (кодовое имя Fennec) — самая мощная и доступная модель Anthropic для автономных агентов (Agents). Она становится моделью по умолчанию для всех пользователей. Ключевые особенности: * **Мощность:** Производительность в задачах на программирование, логику и работу с инструментами (браузер, терминал) почти догоняет флагманскую Opus 4.8, при этом значительно превосходит GPT-5.5 в некоторых тестах (например, SWE-bench Pro). * **Доступность:** Мгновенно доступна глобально для Free и Pro-аккаунтов. Цена API ограничена до 31 августа: $2/М токенов (ввод) и $10/М токенов (вывод). После этого — $3 и $15 соответственно, что все равно значительно дешевле Opus ($5/$25) и GPT-5.5 ($5/$30). * **Безопасность:** Исключительно низкий уровень успешных атак (0.19% на подсказки, 0.93% на браузер), превосходящий в этом даже флагманские модели конкурентов. * **Контекст:** Выход Sonnet 5 компенсирует недоступность ожидаемой Fable 5, предлагая "рабочую лошадку" для разработчиков. Модель эффективно закрывает разрыв между дорогими топовыми и менее способными доступными моделями. Итог: Sonnet 5 предлагает производительность уровня флагманов по цене средней модели, становясь самым практичным и экономичным выбором для выполнения сложных задач.

marsbit07/01 07:49

Срочно, доступная версия Claude 5 появилась, каждый может её использовать

marsbit07/01 07:49

Только что Anthropic представил Sonnet 5, производительность близка к Opus 4.8, но не обязательно дешевле

Только что Anthropic представила новую модель Claude Sonnet 5, назвав её «самой агентной версией Sonnet на сегодняшний день». Модель способна планировать, использовать такие инструменты, как браузер и терминал, и автономно работать на уровне, который ещё несколько месяцев назад требовал более крупных и дорогих моделей. По сравнению с Sonnet 4.6, Sonnet 5 демонстрирует значительный прирост производительности в рассуждениях, использовании инструментов, программировании и интеллектуальной работе, приближаясь к возможностям Opus 4.8, но по более низкой цене. На графиках видно, что Sonnet 5 (оранжевая линия) обеспечивает более широкий диапазон вариантов баланса стоимость-производительность, чем Sonnet 4.6 (серая линия). При среднем уровне «усилий» он значительно повышает экономическую эффективность, а при более высоком — в некоторых задачах может сравниться с Opus 4.8 (жёлтая линия). Ранние пользователи отмечают возросшую автономность и способность выполнять сложные задачи, где предыдущие Sonnet-модели останавливались. В оценках безопасности Sonnet 5 в целом улучшился по сравнению с Sonnet 4.6, демонстрируя более низкий уровень галлюцинаций и менее рискованное поведение, хотя и немного уступает Opus 4.8. Однако анализ затрат от Artificial Analysis показывает, что из-за увеличения расхода токенов стоимость выполнения задачи на Sonnet 5 составляет около $2,29, что примерно в 2 раза дороже Sonnet 4.6 и на 15% дороже Opus 4.8, делая его одной из самых дорогих в эксплуатации моделей. Sonnet 5 доступен по специальной вводной цене до 31 августа 2026 года: $2 за 1 млн токенов на входе и $10 на выходе. После этой даты стандартная цена составит $3 и $15 соответственно. Важно отметить обновление токенизатора: тот же текст теперь может преобразовываться в большее количество токенов (в 1.0–1.35 раза больше), поэтому вводная цена призвана сохранить общую стоимость использования на прежнем уровне. Также были увеличены лимиты запросов (rate limits) для поддержки режимов с высоким уровнем «усилий».

marsbit07/01 00:37

Только что Anthropic представил Sonnet 5, производительность близка к Opus 4.8, но не обязательно дешевле

marsbit07/01 00:37

Только что, OpenClaw и Cursor вторглись в телефоны! Agent теперь в кармане

**AI-агенты теперь в вашем кармане: OpenClaw и Cursor выпускают нативные мобильные приложения** Произошёл ключевой прорыв: мощные AI-агенты окончательно вышли за пределы браузера и настольных компьютеров. В один день два известных проекта, OpenClaw и Cursor, анонсировали нативные мобильные приложения, что делает продвинутый ИИ-ассистент доступным в любое время и в любом месте прямо с iPhone или Android-устройства. **OpenClaw** представляет собой полноценную локальную операционную систему для персональных AI-агентов. Её новое приложение позволяет удалённо подключаться к вашему приватному "шлюзу" (Gateway) и напрямую управлять агентами: общаться, запускать задачи, контролировать и утверждать их действия. Приложение получает доступ к ключевым функциям телефона (камера, GPS, контакты, календарь), сохраняя архитектуру local-first — все данные и ключи остаются под контролем пользователя. Почти одновременно **Cursor**, популярный ИИ-инструмент для программистов, запустил публичную бета-версию приложения для iOS. Его ключевая фишка — запуск "облачных агентов". Разработчик может с телефона инициировать выполнение сложной задачи (например, исправление бага или создание PR) в изолированной облачной среде. Агент работает асинхронно, даже когда телефон выключен, а пользователь получает уведомление, когда результат готов к проверке и слиянию. Эти релизы знаменуют собой важный сдвиг: агенты больше не привязаны к рабочему месту. Они обретают автономию, работая в фоне, а роль человека всё больше смещается от оператора к контролёру и утверждающему решения. Эпоха, когда мощный ИИ-помощник всегда под рукой, в буквальном смысле в кармане, началась.

marsbit06/30 02:31

Только что, OpenClaw и Cursor вторглись в телефоны! Agent теперь в кармане

marsbit06/30 02:31

活动图片