# Сопутствующие статьи по теме Многоязычный

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Многоязычный", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Google Deep Think доминирует в восьми языковых олимпиадах, самостоятельно решает 4 нерешенные проблемы, рушит барьеры в науке

Google DeepMind представила новый ИИ Gemini Deep Think, который показал выдающиеся результаты в восьми международных олимпиадах на разных языках, включая русский. Модель достигла уровня золотых медалистов в математических, физических и химических соревнованиях, а также продемонстрировала мощные способности в программировании. Особенно впечатляющими стали результаты на японском и французском языках, где ИИ набрал 100% баллов. На китайском языке модель показала высокий результат в математической олимпиаде (86,3%), но менее впечатляющий — в программировании (63,3%), что указывает на различия между чистым推理 и практической реализацией кода. Google подчеркивает, что цель проекта —打破语言ковые барьеры в научных исследованиях, позволяя учёным со всего мира использовать ИИ на родном языке. Модель уже помогла решить несколько нерешённых математических проблем и участвовала в написании научных работ. Однако некоторые эксперты отмечают, что результаты пока не имеют независимого подтверждения, и детали тестирования не раскрыты.

marsbit04/08 10:32

Google Deep Think доминирует в восьми языковых олимпиадах, самостоятельно решает 4 нерешенные проблемы, рушит барьеры в науке

marsbit04/08 10:32

Microsoft открывает доступ к передовому семейству голосовых ИИ VibeVoice: обработка 90-минутных диалогов с несколькими говорящими, GitHub быстро набирает 27K звезд

Microsoft открыла исходный код семейства передовых голосовых ИИ-моделей VibeVoice, включающих распознавание речи (ASR) и преобразование текста в речь (TTS). Проект, получивший около 27 000 звезд на GitHub, позволяет однократно обрабатывать до 90 минут многопользовательского диалога. Ключевые модели: - VibeVoice-ASR-7B: преобразует аудио длиной до 60 минут в структурированный текст с распознаванием говорящих, временными метками и поддержкой 50+ языков. - VibeVoice-TTS-1.5B: генерирует до 90 минут естественной речи с поддержкой до 4 голосов, имитируя паузы и эмоции. - VibeVoice-Realtime-0.5B: обеспечивает задержку всего ~300 мс для потокового TTS. Проект использует лицензию MIT, поддерживает локальное развертывание и включает механизмы безопасности, такие как аудио-водяные знаки. Модели доступны на GitHub и Hugging Face.

marsbit03/30 07:17

Microsoft открывает доступ к передовому семейству голосовых ИИ VibeVoice: обработка 90-минутных диалогов с несколькими говорящими, GitHub быстро набирает 27K звезд

marsbit03/30 07:17

活动图片