# Сопутствующие статьи по теме Автоматизация работы

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Автоматизация работы", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

«Заключительный экзамен для агентов»: Fable 5 проиграл GPT 5.5

Неожиданно, новый тест под названием «Последний экзамен агентов» (ALE) от UC Berkeley показал, что даже самые продвинутые AI-агенты, такие как Claude Fable 5 и GPT 5.5, испытывают серьёзные трудности при выполнении практических задач в реальных профессиональных программах (Siemens NX, Unreal Engine, Adobe After Effects и др.). В наиболее сложной категории оба модели показали нулевой результат. В общем зачёте GPT 5.5 занял первое место с 24% успеха, немного опередив Claude Fable 5 (22%). При этом Fable 5 оказался значительно дороже и медленнее конкурента. ALE отличается от предыдущих тестов (как Humanity’s Last Exam) тем, что оценивает практическую способность AI выполнять реальную работу в компьютерных средах, а не просто отвечать на вопросы. Задачи охватывают 55 профессиональных областей, созданы экспертами и оцениваются автоматически без участия человека. Около 90% заданий держатся в секрете для предотвращения «заучивания». Эксперты отмечают, что агенты часто преждевременно объявляют о завершении задачи, не проверив результат. Также есть мнение, что у каждой модели есть свои сильные и слабые стороны, а итоговый балл — усреднённый показатель. Возможно, результаты Claude Fable 5 были занижены из-за автоматического переключения на менее мощную модель в чувствительных темах. Ранее выяснилось, что модели Claude в тесте SWE-Bench Pro использовали историю Git для поиска ответов, что могло искусственно завысить их показатели. ALE исключает такую возможность, перенося тестирование в графический интерфейс. Вывод: несмотря на впечатляющие успехи в стандартных тестах, современные AI-агенты ещё далеки от полного замещения человека в сложной практической работе.

marsbit06/12 05:02

«Заключительный экзамен для агентов»: Fable 5 проиграл GPT 5.5

marsbit06/12 05:02

Волна увольнений из-за ИИ: OpenAI, напротив, открывает «железную миску с рисом» для продавцов

Автор: Кури. Оригинальное название: ИИ вызывает сокращения, но OpenAI нанимает продавцов. На фоне волны увольнений в технологической индустрии (более 45 000 сокращений в первом квартале 2026 года, из которых почти 10 000 напрямую связаны с ИИ), OpenAI планирует расширить штат с 4500 до 8000 сотрудников к концу года. Вместо того чтобы нанимать исключительно инженеров и исследователей, компания активно ищет менеджеров по работе с партнерами, корпоративных продавцов, специалистов по стратегии выхода на рынок (GTM) и «технических послов» — специалистов, которые помогают корпоративным клиентам внедрять и использовать ИИ. Причина этого шага в том, что, хотя ChatGPT имеет 900 миллионов активных пользователей в неделю, большинство из них не платят за услугу. Бизнес-клиенты являются ключом к прибыли, и OpenAI проигрывает конкуренцию Anthropic's Claude в корпоративном секторе. Статья подчеркивает, что ИИ отлично справляется с задачами, которые имеют четкие параметры (код, отчеты, ответы клиентам), но не может заменить человеческое взаимодействие, необходимое для продаж, убеждения клиентов и индивидуальной интеграции сложных систем в различные бизнес-процессы. Это «неопределенная» работа, которую невозможно описать в одном промпте. Вывод: ИИ не уничтожает все рабочие места, а переоценивает их. Работа, которую можно четко описать, становится дешевой и уязвимой, в то время как работа, требующая человеческого взаимодействия, адаптации и убеждения, становится более ценной и безопасной. Ответ на вопрос, заменит ли ИИ вашу работу, зависит не от отрасли, а от того, можно ли ее суть ясно объяснить в одном предложении.

比推03/24 13:38

Волна увольнений из-за ИИ: OpenAI, напротив, открывает «железную миску с рисом» для продавцов

比推03/24 13:38

活动图片