# Сопутствующие статьи по теме SOTA

Новостной центр HTX предлагает последние статьи и углубленный анализ по "SOTA", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Большая модель ставит оценку изображениям не только "на слово", используя структурные диаграммы и спектрограммы в качестве "материальных доказательств", для оценки изображений применяются "визуальные доказательства".

Мультимодальные большие языковые модели (MLLM) часто неточно оценивают качество изображений из-за «семантического смещения» — они фокусируются на высокоуровневом содержании, а не на визуальных дефектах. Чтобы решить эту проблему, исследователи из Северо-Западного политехнического университета и Гонконгского университета науки и технологий представили IQA-T1 — новую архитектуру, которая заставляет MLLM оценивать качество на основе визуальных доказательств. Ключевая идея — предоставить модели набор специализированных инструментов для анализа. Во время работы модель самостоятельно решает, какие инструменты использовать для генерации структурированных «доказательств»: карты остаточного шума, спектры Фурье, карты согласованности градиентов и другие. Эти визуальные доказательства последовательно интегрируются в цепочку рассуждений, что делает оценку объективной и объяснимой. Обучение проходит в два этапа: контролируемая тонкая настройка (SFT) учит модель использовать инструменты и связывать доказательства с оценкой, а обучение с подкреплением (RL) оптимизирует стратегию их вызова, поощряя эффективность и избегая избыточности. Для обучения создан новый набор данных Q-Tool, содержащий 11k мультимодальных цепочек рассуждений с доказательствами. В тестах на 7 наборах данных IQA-T1 показала наилучший средний результат (PLCC 0.795 / SRCC 0.784), превзойдя современные методы. Модель не только точнее оценивает качество, особенно на синтетических и алгоритмических искажениях, но и предоставляет понятную, основанную на доказательствах цепочку рассуждений, делая процесс оценки прозрачным. Работа открывает путь к созданию более надежных и интерпретируемых систем визуального анализа.

marsbit07/20 07:48

Большая модель ставит оценку изображениям не только "на слово", используя структурные диаграммы и спектрограммы в качестве "материальных доказательств", для оценки изображений применяются "визуальные доказательства".

marsbit07/20 07:48

Новый прорыв в воплощенном интеллекте: Amap полностью открывает исходный код базовой модели универсального робота ABot-M0

Ключевой прорыв в области воплощенного ИИ: Amap полностью открывает исходный код базовой модели универсального робота ABot-M0. Модель ABot-M0, первая в мире архитектурно унифицированная базовая модель для операционного воплощенного интеллекта роботов, нацелена на создание "универсального мозга" для адаптации к роботам различных форм. Она устанавливает новые рекорды SOTA, демонстрируя 80.5% успешности выполнения задач в бенчмарке Libero-Plus — на 30% выше, чем у предыдущего эталона Pi0. Amap открывает исходный код в трёх ключевых аспектах: 1. **Данные**: Крупнейший в отрасли набор универсальных данных для роботов UniACT с более чем 6 миллионами реальных траекторий. 2. **Алгоритмы**: Архитектура модели, инновационные алгоритмы обучения манифеста действий (AML) и двухпоточной системы восприятия. 3. **Модели**: Предобученные модели с полным набором инструментов для лёгкого развёртывания. Это открытие преодолевает барьеры между разнородным аппаратным обеспечением, ускоряя переход воплощённого ИИ из лабораторий в промышленность и бытовые сценарии.

marsbit04/01 08:20

Новый прорыв в воплощенном интеллекте: Amap полностью открывает исходный код базовой модели универсального робота ABot-M0

marsbit04/01 08:20

Спустя 6 дней после выпуска ChatGPT Health, OpenAI уступили лидерство в собственном медицинском бенчмарке

Китайская компания Baichuan Intelligent представила новую модель искусственного интеллекта Baichuan-M3, которая превзошла OpenAI GPT-5.2 High в медицинском тесте HealthBench, набрав 65,1 балла и установив новый рекорд. Модель также показала наименьший уровень галлюцинаций (3,5%) без использования внешних инструментов. Это достижение стало возможным благодаря технологии Fact Aware RL, которая улучшает точность диагностики и снижает риски ошибок. Кроме того, Baichuan разработала собственный тест SCAN-bench, ориентированный на диалоговые способности ИИ в медицине. В этом тесте модель превзошла врачей-людей благодаря более широким междисциплинарным знаниям и терпеливому подходу к диагностике. Компания планирует внедрять M3 в потребительские продукты, делая акцент на серьёзных медицинских направлениях, таких как онкология, а не на психологической поддержке. По мнению основателя Baichuan Wang Xiaochuan, ИИ может увеличить доступность качественной медицины и со временем передать больше медицинских решений в руки пациентов. Это также станет шагом к созданию универсального искусственного интеллекта (AGI).

marsbit01/14 02:33

Спустя 6 дней после выпуска ChatGPT Health, OpenAI уступили лидерство в собственном медицинском бенчмарке

marsbit01/14 02:33

Маяк указывает направление, факел оспаривает суверенитет: скрытая война за право распределения ИИ

Автор Пан Чжисюн анализирует скрытую борьбу за распределение ИИ, сравнивая две модели: «маяки» и «факелы». «Маяки» — это передовые закрытые модели (OpenAI, Google и др.), требующие огромных ресурсов и определяющие пределы возможностей ИИ, но создающие риски зависимости, уязвимости и потери контроля над данными. «Факелы» — это открытые и локально развертываемые модели (DeepSeek, Qwen и др.), которые делают ИИ доступным, приватным и адаптируемым, но перекладывают ответственность за безопасность на пользователей. Обе модели взаимодополняемы: «маяки»推动创新, а «факелы» обеспечивают широкое распространение и устойчивость. Ключевой вопрос — кто определяет стандарты ИИ, распределяет риски и контролирует данные. В будущем сохранится двойная стратегия: сочетание мощных централизованных систем и локальных решений для баланса между развитием и суверенитетом.

marsbit12/22 11:15

Маяк указывает направление, факел оспаривает суверенитет: скрытая война за право распределения ИИ

marsbit12/22 11:15

活动图片