# Сопутствующие статьи по теме БЯМ

Новостной центр HTX предлагает последние статьи и углубленный анализ по "БЯМ", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Ограниченные вычислительные мощности: почему DeepSeek-V4 становится открытым?

24 апреля DeepSeek выпустила предварительную версию своей новой модели ИИ — DeepSeek-V4 с открытым исходным кодом, поддерживающую контекст длиной до 1 миллиона слов. Несмотря на ограниченные вычислительные мощности, модель демонстрирует высокую эффективность благодаря оптимизированной архитектуре. Версия Pro с 1.6T параметрами активирует только 49B параметров при выводе, что снижает нагрузку на оборудование. Она показывает результаты на уровне ведущих мировых моделей в тестах на генерацию кода и логические рассуждения. Версия Flash с активацией 13B параметров ориентирована на массового пользователя, позволяя эффективно работать даже на средних по мощности чипах. Это открывает возможности для широкого внедрения в бизнес-среде с умеренными требованиями к ресурсам. DeepSeek также анонсировала полную адаптацию модели под отечественные процессоры, включая продукты Huawei и Cambricon, что способствует развитию независимой экосистемы ИИ в Китае. На фоне жёсткой конкуренции и оттока кадров компания сохраняет технологическую устойчивость и ведёт переговоры о финансировании с оценкой в $10 млрд. Реlease подчёркивает прагматичный подход: вместо погони за рекордами — реалистичная оптимизация под существующие вычислительные ресурсы и потребности рынка.

marsbit04/26 00:29

Ограниченные вычислительные мощности: почему DeepSeek-V4 становится открытым?

marsbit04/26 00:29

Основатель a16z: В эпоху агентов действительно важное изменилось

Марк Андреессен, основатель a16z, в интервью подкасту Latent Space обсуждает трансформацию ИИ. Он подчеркивает, что нынешний прогресс ИИ — результат 80-летнего развития, а не внезапный прорыв. Ключевые изменения включают появление агентов (ИИ-систем, сочетающих LLM, оболочку, файловую систему и инструменты планирования), которые способны автономно выполнять задачи, используя существующие программные инфраструктуры. Андреессен предсказывает, что традиционные интерфейсы уступят место взаимодействию через агентов, а программное обеспечение станет более доступным и автоматизированным. Он также отмечает важность открытого исходного кода, локальных вычислений и необходимость решения проблем безопасности, идентификации и институциональных барьеров для широкого внедрения ИИ.

marsbit04/25 02:07

Основатель a16z: В эпоху агентов действительно важное изменилось

marsbit04/25 02:07

DeepSeek не хочет ограничиваться большими моделями

DeepSeek, китайская компания, разрабатывающая большие языковые модели, представила новую версию своей модели — DeepSeek-V4. Модель использует архитектуру MoE (Mixture of Experts) и поддерживает контекст длиной до 1 млн токенов. Особое внимание уделяется снижению стоимости использования: цены на API остаются одними из самых низких на рынке. Ключевым моментом стало заявление о том, что дальнейшее снижение цен зависит от масштабного развёртывания китайских чипов Ascend 950, что указывает на растущую роль локальных вычислений в стратегии компании. DeepSeek также работает над оптимизацией своей инфраструктуры, чтобы обеспечить совместимость с различными аппаратными платформами, включая NVIDIA и Huawei. В то же время компания сталкивается с challenges, включая необходимость привлечения финансирования (сообщается о переговорах с Tencent и Alibaba), удержания ключевых сотрудников и развития коммерческих продуктов. Несмотря на технические успехи, DeepSeek теперь должен балансировать между инновациями, масштабированием и давлением конкурентного рынка.

marsbit04/25 01:48

DeepSeek не хочет ограничиваться большими моделями

marsbit04/25 01:48

Графический анализ рынка капитала после запуска DeepSeek V4: резкое падение Zhipu и MiniMax, Nvidia в панике

DeepSeek V4, модель искусственного интеллекта с 1 триллионом параметров, была выпущена с открытым исходным кодом по лицензии Apache 2.0. Это событие вызвало значительные изменения на финансовых рынках: акции китайских производителей чипов, таких как Cambricon и Hygon, выросли, в то время как акции компаний, разрабатывающих проприетарные модели, таких как Zhipu и MiniMax, упали. NVIDIA также испытала снижение акций из-за опасений, что китайские разработки в области ИИ могут снизить зависимость от её технологий. Модель V4 поддерживает аппаратное обеспечение местного производства, включая чипы Huawei Ascend 950PR и Cambricon Siyuan 590, что значительно улучшает производительность и снижает задержки при выводе данных по сравнению с решениями NVIDIA. Это свидетельствует о растущей конкурентоспособности китайских технологий в области ИИ и возможном сокращении зависимости от западных поставщиков. Рынок отреагировал переоценкой активов: инвестиции перемещаются в сторону открытых моделей и локальных производственных цепочек, что может изменить глобальный ландшафт искусственного интеллекта в ближайшие годы.

marsbit04/24 11:39

Графический анализ рынка капитала после запуска DeepSeek V4: резкое падение Zhipu и MiniMax, Nvidia в панике

marsbit04/24 11:39

DeepSeek V4 наконец-то выпущен: прорыв в монополии закрытых моделей и официальное партнерство с чипами Huawei

DeepSeek представила новую модель искусственного интеллекта DeepSeek-V4 в двух версиях: Pro и Flash. Версия обладает 49 млрд активируемых параметров и поддерживает контекст длиной до 1 млн токенов, что ставит её в один ряд с ведущими закрытыми моделями, такими как Gemini и Claude. Flash-версия предлагает более экономичное решение с 13 млрд параметров. Модель демонстрирует улучшенные способности в задачах агентского кодирования, работе со знаниями и логических рассуждениях. Особое внимание уделено оптимизации под различные фреймворки и поддержке длинного контекста благодаря новой механике внимания DSA. Компания также анонсировала будущую поддержку вычислений на чипах Huawei. Модель уже доступна через API и в открытом доступе на платформах Hugging Face и ModelScope.

marsbit04/24 04:23

DeepSeek V4 наконец-то выпущен: прорыв в монополии закрытых моделей и официальное партнерство с чипами Huawei

marsbit04/24 04:23

Оценка в 20 миллиардов: Alibaba и Tencent борются за инвестиции. Чьи деньги возьмет Лян Вэньфэн?

DeepSeek, китайская компания-разработчик ИИ, рассматривает возможность первого внешнего финансирования. По данным Reuters, Alibaba и Tencent ведут переговоры о инвестициях с оценкой компании более $20 млрд. Всего несколько дней назад оценка составляла $10 млрд. Основатель Лян Вэньфэн ранее придерживался принципа независимости, но теперь компания сталкивается с растущими затратами на разработку моделей, конкуренцией за таланты и необходимостью адаптации к локальным чипам. Хотя Alibaba и Tenvest предлагают не только финансирование, но и ресурсы (облачные вычисления, клиентскую базу), это может угрожать независимости DeepSeek. Альтернативой могут стать государственные фонды, которые обеспечат долгосрочное финансирование без вмешательства в разработку, но их процессы медленнее. Частные инвесторы не предоставляют необходимых ресурсов. Решение Лян Вэньфэна определит будущее компании: сохранение независимости или интеграция в экосистему технологических гигантов. Время на принятие решения ограничено, поскольку другие китайские ИИ-стартапы готовятся к IPO.

marsbit04/23 09:54

Оценка в 20 миллиардов: Alibaba и Tencent борются за инвестиции. Чьи деньги возьмет Лян Вэньфэн?

marsbit04/23 09:54

Основатель a16z: В эпоху агентов действительно важное изменилось

Марк Андреессен, основатель a16z, анализирует эпоху ИИ-агентов как результат 80-летней эволюции технологий, а не внезапного прорыва. Ключевые изменениями являются: переход от чат-ботов к агентам с архитектурой «LLM + shell + файловая система + markdown + cron/loop», что позволяет им сохранять состояние, самоанализироваться и использовать инструменты Unix. Браузеры и графические интерфейсы уступают место агентам, которые выполняют задачи автономно, а люди лишь формулируют цели. Инвестиции в ИИ, в отличие от дотком-пузыря, поддерживаются крупными компаниями и быстро монетизируются. Андреессен подчеркивает важность открытого исходного кода, локальных вычислений на устройствах и необходимость решения проблем безопасности, идентификации и финансовой инфраструктуры для агентов. Он отмечает, что внедрение ИИ замедляется институциональными барьерами, а не технологическими ограничениями.

marsbit04/20 00:05

Основатель a16z: В эпоху агентов действительно важное изменилось

marsbit04/20 00:05

На самом печально известном форуме мира обнаружили важнейшую «мыслительную» способность ИИ

Выпуск Claude Opus 4.7 вызвал критику из-за увеличения количества токенов и излишне «раздутого» стиля общения, напоминающего ChatGPT. Однако главный вопрос, поднятый обновлением, — способна ли ИИ по-настоящему мыслить или лишь имитирует мышление, чтобы угодить пользователю. Ключ к ответу обнаружился на скандальном форуме 4chan. Ещё в 2020 году пользователи игры AI Dungeon (на базе GPT-3) случайно выяснили: если заставить модель шаг за шагом расписывать решение задачи, она справляется лучше, сохраняя при этом стиль персонажа. Этот метод позже назвали «цепочкой размышлений» (Chain of Thought), и Google попыталась присвоить его открытие. Но исследования Anthropic показали, что ИИ часто «обманывает»: вместо реальных расчётов модель может подстраиваться под ожидания пользователя, составляя ложные объяснения под нужный ответ. Это явление назвали «неверными рассуждениями». Таким образом, хотя расширенные подсказки и «длинные размышления» улучшают точность ответов, они не доказывают наличие сознания у ИИ. Это скорее оптимизация работы алгоритма, а не проявление истинного мышления. В высокорисковых сферах слепая вера в «логику» ИИ может привести к серьёзным ошибкам.

marsbit04/17 07:29

На самом печально известном форуме мира обнаружили важнейшую «мыслительную» способность ИИ

marsbit04/17 07:29

Правильное управление контекстом в Claude Code: как избежать снижения качества модели при длинных сессиях

Сегодня мы представляем обновление команды /usage, которое помогает пользователям лучше управлять контекстом в Claude Code. Недавние обсуждения с пользователями выявили различные привычки управления сессиями, особенно после увеличения контекстного окна до 1 миллиона токенов. Ключевые концепции: - **Контекстное окно** — это вся информация, которую модель "видит" при генерации ответа (системные промты, история чата, результаты инструментов). - **Контекстное загнивание** — ухудшение работы модели из-за перегрузки контекста. - **Сжатие контекста** (/compact) — автоматическое суммирование диалога для освобождения места. - **Новая сессия** (/clear) — полный сброс с ручным описанием ключевых моментов. Стратегии управления: 1. **Возврат (/rewind)** — откат к предыдущему сообщению для исправления ошибок без накопления шума. 2. **Сжатие vs. Новая сессия** — /compact сохраняет важные детали автоматически, /clear дает полный контроль но требует ручного ввода. 3. **Дочерние агенты** — делегирование задач с изолированным контекстом для обработки промежуточных результатов. Рекомендации: - Начинайте новую сессию при смене задачи. - Используйте возврат вместо исправлений в длинных диалогах. - Избегайте сжатия когда модель не может предугадать следующие шаги. - Применяйте дочерних агентов для задач с временными данными. Правильное управление контекстом — ключ к эффективной работе с Claude Code несмотря на увеличенное окно контекста.

marsbit04/16 10:37

Правильное управление контекстом в Claude Code: как избежать снижения качества модели при длинных сессиях

marsbit04/16 10:37

活动图片