# Сопутствующие статьи по теме Производительность

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Производительность", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

GPT-5.6 впервые преодолел порог IQ в 130 баллов — гениальности, превзойдя 99% человечества

GPT-5.6 набрал 136 баллов в закрытом IQ-тесте Tracking AI, впервые преодолев порог в 130 баллов, что считается уровнем гениальности у людей и превышает показатели 99% человечества. Этот результат был достигнут на специальном «офлайн-наборе» вопросов, разработанном для предотвращения заучивания ответов, что подтверждает его надежность. Различные версии модели, включая визуальную, показали одинаково высокий результат, опередив конкурентов вроде Claude-5 Fable (130 баллов). Практические тесты разработчиков также демонстрируют возросшие возможности GPT-5.6. Модель успешно создавала сложные симуляции и приложения по одному запросу, эффективно исправляла ошибки в коде и проявляла более практичный подход к решению реальных задач по сравнению с некоторыми другими ИИ. Несмотря на впечатляющие баллы в тестах на логику и абстрактное мышление, эксперты отмечают, что стандартные IQ-тесты измеряют лишь узкий спектр способностей и не отражают всей сложности интеллекта, включая надежность, использование инструментов или адаптацию к новым, незнакомым ситуациям. Тем не менее, пользовательский опыт показывает, что GPT-5.6 становится лучше в объединении «умения решать тесты» и «умения выполнять практическую работу».

marsbit5 ч. назад

GPT-5.6 впервые преодолел порог IQ в 130 баллов — гениальности, превзойдя 99% человечества

marsbit5 ч. назад

GPT-5.6 Sol внезапно поумнел? Бюджет на рассуждения сократили с 960 до 128. Моделей с фиксированным интеллектом больше нет?

Пользователи сообщают о резком снижении производительности GPT-5.6 Sol (особенно уровня Max) при выполнении сложных задач, требующих глубоких рассуждений и вычислений. Сообщество обнаружило недокументированный внутренний параметр «juice value», который, по-видимому, контролирует вычислительный бюджет для рассуждений. Его значение для уровня Max упало с 960 до 128. Представитель OpenAI ТибоСоттио заявил, что это не «оглупление» модели, а часть эксперимента по оптимизации использования ресурсов и анализу неожиданно высокого потребления токенов после выпуска GPT-5.6. Он подтвердил временное снижение «juice values» и контекстного окна (с 372K до 272K токенов) для отладки, пообещав вернуть настройки. Инцидент показал, что фактические возможности модели в продакшене могут динамически регулироваться платформой для контроля затрат. Это ставит под вопрос прозрачность и предсказуемость услуги для пользователей, особенно в корпоративном секторе, где ИИ становится частью инфраструктуры.

marsbitВчера 03:30

GPT-5.6 Sol внезапно поумнел? Бюджет на рассуждения сократили с 960 до 128. Моделей с фиксированным интеллектом больше нет?

marsbitВчера 03:30

Все в сети ругают Claude за «глупость», Anthropic объясняет: проблема не в модели, а в вас

Клод стал глупее? Нет, пользователи просто не понимают разницу между «моделью» (Model) и «усилием» (Effort). Объяснение от Anthropic: Model — это «мозг» ИИ, его замороженные во время обучения возможности. Effort — это «отношение к работе», то, насколько тщательно ИИ выполнит задачу: проверит ли файлы, запустит ли тесты, выполнит ли многошаговую работу до конца без запросов. В марте 2024 многие жаловались на «глупость» Claude Code. Оказалось, Anthropic тихо изменил *стандартный* уровень Effort с high на medium для снижения задержек. Когда через месяц настройку вернули, производительность «восстановилась». Проблема была не в модели, а в усилии. **Ключевое правило:** если Claude пропускает шаги, ленится, просит лишней информации — повышайте Effort. Если он явно старается, но дает принципиально неверный результат даже с идеальным промптом — меняйте модель на более мощную. Sonnet с высоким Effort может обойти Opus с низким на многих задачах, требующих тщательности. Дорогой Fable нужен только для узкоспециализированных проблем. Вывод: эра простого выбора самой мощной модели заканчивается. Теперь ключевой навык — грамотное «управление» ИИ: распределение задач между моделями с разным уровнем усилий для оптимального результата и стоимости.

marsbit07/12 05:58

Все в сети ругают Claude за «глупость», Anthropic объясняет: проблема не в модели, а в вас

marsbit07/12 05:58

Обновление BNB Chain Haber даёт разработчикам ещё одну причину следить за стремлением сети к повышению пропускной способности

BNB Chain представила обновление Haber, направленное на повышение производительности сети и улучшение опыта разработчиков и валидаторов. Обновление включает новые спецификации для нод, фокусируясь на увеличении скорости и надежности транзакций, что важно в условиях конкуренции за более быструю и дешевую блокчейн-инфраструктуру. Хотя отдельное обновление не меняет рынок мгновенно, оно является значимым сигналом для отрасли, стремящейся понять направление движения капитала, пользователей и регуляций. Для разработчиков стабильная и предсказуемая техническая база критически важна для создания готовых продуктов. В текущих рыночных условиях, где ликвидность избирательна, а регуляторное давление сохраняется, проекты, которые последовательно улучшают свою основу, с большей вероятностью удержат внимание в долгосрочной перспективе. Таким образом, обновление Haber следует рассматривать не как изолированное событие, а в контексте общего тренда на совершенствование базовой инфраструктуры. Это развитие, за которым стоит наблюдать, чтобы оценить его реальное влияние на пропускную способность сети BNB Chain в ближайшие периоды.

bitcoinist07/11 00:37

Обновление BNB Chain Haber даёт разработчикам ещё одну причину следить за стремлением сети к повышению пропускной способности

bitcoinist07/11 00:37

Кевин Уорш тихо перестраивает ФРС через пять рабочих групп

Автор: qinbafrank Федеральная резервная система США объявила о создании пяти рабочих групп под общим названием "Группы по совершенствованию денежно-кредитной политики при Председателе". В их состав вошли 15 внешних экспертов, которых будут поддерживать сотрудники ФРС. Группы займутся независимыми исследованиями и представят выводы Комитету по операциям на открытом рынке (FOMC). Эти группы охватывают всю "операционную систему" монетарной политики: от сбора данных и моделирования производительности, занятости и инфляции до инструментов баланса ФРС и внешних коммуникаций. Наблюдатели отмечают, что инициатива председателя ФРС Кевина Уорша обладает характерными чертами: 1) Запущена высшим руководством. 2) Преодолевает границы между существующими подразделениями. 3) Создает параллельные каналы отчетности. 4) Позволяет обойти бюрократические процедуры и ведомственные интересы. 5) Позволяет быстро пересматривать политическую повестку через "проектирование на высшем уровне". 6) Концентрирует полномочия по координации и экспертизе в специальной структуре. Автор проводит параллель с подобными рабочими группами, используемыми в реформах госорганов. Анализ предполагает, что до завершения работы этих групп Уорш, вероятно, будет воздерживаться от резких шагов. В будущем стоит наблюдать, станут ли группы постоянными, и не начнут ли их выводы де-факто определять политику председателя, оставляя FOMC лишь роль утверждающего органа.

marsbit07/10 10:24

Кевин Уорш тихо перестраивает ФРС через пять рабочих групп

marsbit07/10 10:24

Сегодня Claude Cowork получил большое обновление: закройте ноутбук, он поработает за вас всю ночь

Claude Cowork от Anthropic выпустил масштабное обновление, теперь доступное на мобильных устройствах и в веб-версии. Ключевое нововведение — возможность запускать длительные задачи в облаке, независимо от состояния вашего компьютера. Пользователь может поставить задачу (например, собрать данные, подготовить документы, написать черновик письма), и Cowork самостоятельно разобьет ее на шаги, подключится к необходимым сервисам (Slack, почта, календарь) и начнет выполнение. Когда потребуется решение человека, система отправит уведомление на телефон. Это устраняет необходимость постоянно держать компьютер включенным. Теперь можно, например, смотреть футбол или быть в пути, контролируя прогресс и давая указания прямо с телефона. Обновление также объединило Chat и Cowork в один интерфейс. Ведущие технологические компании (OpenAI, Microsoft, Google) активно развивают аналогичные агентские модели, ориентируясь на массового пользователя и повседневные офисные задачи, а не только на разработчиков. Цель — стать неотъемлемой частью рабочего процесса обычного человека.

marsbit07/08 00:56

Сегодня Claude Cowork получил большое обновление: закройте ноутбук, он поработает за вас всю ночь

marsbit07/08 00:56

После наблюдения за Уоршем вблизи, главный экономист Morgan Stanley настаивает: ФРС не поднимет ставки в этом году

Автор: Чжао Ин После личного наблюдения за новым председателем ФРС Уолшем главный экономист Morgan Stanley Сет Карпентер заявил, что Федрезерв не будет повышать процентные ставки в этом году. В своем отчете после участия в ежегодном собрании ЕЦБ в Синтре, Португалия, Карпентер отметил, что позиция Уолша на политическом форуме сохранила тон с его инаугурационной пресс-конференции — твердую приверженность ценовой стабильности, но избегание конкретных путей достижения этой цели. Карпентер указал на два важных изменения: во-первых, более сбалансированное заявление Уолша о двойном мандате, смещение акцента с почти исключительного фокуса на инфляцию к более четкому признанию цели полной занятости; во-вторых, особое подчеркивание Уолшем того, что последнее заседание по политике (на фоне падения цен на нефть) уже снизило рыночные инфляционные ожидания и премии за срок, что, по мнению Карпентера, делает маловероятным повышение ставки ФРС в июле. При неопределенности в траектории политики ФРС Morgan Stanley сохраняет базовый прогноз об отсутствии повышения ставок в течение всего года, что означает, что рынкам не нужно оценивать риски скорого повышения. Карпентер также обсудил влияние ИИ на денежно-кредитную политику, подвергнув сомнению популярный нарратив о том, что "ИИ вызовет дефляцию и приведет к снижению ставок". Он утверждает, что более быстрый рост производительности означает более высокую равновесную процентную ставку (r*), что еще больше ослабляет логику снижения ставок, и называет простые утверждения о неизбежном снижении ставок из-за ИИ "почти наверняка ошибочными". В отличие от ФРС, политический курс ЕЦБ явно смещен в сторону ужесточения. Базовый прогноз Morgan Stanley предполагает, что ЕЦБ повысит ставки еще на 25 базисных пунктов в сентябре, однако более мягкие данные по инфляции в Европе и значительное падение цен на нефть оставляют пространство для маневра.

marsbit07/06 01:39

После наблюдения за Уоршем вблизи, главный экономист Morgan Stanley настаивает: ФРС не поднимет ставки в этом году

marsbit07/06 01:39

Токены съедают треть зарплат, счет за ИИ в Кремниевой долине вышел из-под контроля

Ключевые выводы из анализа SemiAnalysis: расходы на токены для внутренних ИИ-моделей в некоторых компаниях достигают 30% от фонда заработной платы. При этом производительность возрастает в разы: задачи, требовавшие ранее часов работы, теперь решаются за минуты за несколько долларов. Хотя такие компании, как Uber и Microsoft, столкнулись с неконтролируемым ростом ИИ-расходов и ограничивают бюджеты, анализ показывает, что стоимость токенов будет резко снижаться. За счёт оптимизации ПО (14-кратный рост скорости) и новых аппаратных решений (в 17-32 раза производительнее) стоимость к 2030 году может упасть более чем на 90%. Токен становится новым "средством производства". Несмотря на рекордные инвестиции в ИИ-инфраструктуру (7400 млрд долларов в 2024 году) и текущее отсутствие макроэкономического эффекта, это типичная фаза технологической революции: сначала строится "трубопровод", затем он наполняется "потоком" приложений. Компании, которые уже сейчас эффективно используют ИИ, как SemiAnalysis, получают многократное преимущество в производительности на фоне снижающихся издержек.

marsbit07/06 00:16

Токены съедают треть зарплат, счет за ИИ в Кремниевой долине вышел из-под контроля

marsbit07/06 00:16

活动图片