TGViewer
SOF_news SOF_news @sof_news24 · 297 subscribers
Post #1835 83
🇨🇳🤖 Alibaba представила Qwen3.8-Omni-Flash – мультимодальную ИИ-модель для работы с текстом, изображениями, аудио и видео
Команда Qwen 18 сентября представила Qwen3.8-Omni-Flash – новую модель, ориентированную на мультимодальных ИИ-агентов и обработку информации сразу в нескольких форматах. В отличие от обычных мультимодальных моделей, основным направлением развития стала не просто обработка изображения или видео, а выполнение длительных задач с использованием аудио- и видеоматериалов, программных инструментов и внешних сервисов.
📌 Архитектура
Qwen3.8-Omni-Flash построена на архитектуре Qwen3.8-Flash-Next, открытая версия которой была представлена в августе.
Модель поддерживает:
– контекст до 1 млн токенов;
– одновременную обработку текста, изображений, аудио и видео;
– до 131 тыс. выходных токенов;
– режим рассуждений;
– вызов программных инструментов;
– встроенный веб-поиск;
– работу с многоканальным и пространственным аудио.
Текущая версия через обычный API формирует текстовый ответ. Количество параметров и полный состав Qwen3.8-Omni-Flash разработчики пока не раскрыли.
📌 Главная особенность – мультимодальные ИИ-агенты
Модель может не только анализировать видеозапись или аудиофайл, но и самостоятельно определять необходимые этапы работы, обращаться к инструментам, выбирать нужные фрагменты материала и продолжать анализ на основании полученных результатов.
В качестве основных сценариев разработчики называют программирование, работу с документами и графическими интерфейсами, анализ длительных видеозаписей, мультимедийное реферирование, монтаж видео, создание музыкальных клипов и обработку аудиовизуальных материалов.
📌 Программирование
Несмотря на значительно более развитую работу с аудио и видео, показатели модели в программировании практически не отличаются от Qwen3.8-Flash-Next. Таким образом, расширение мультимодальной части практически не привело к снижению возможностей основной модели при решении программных и логических задач.
🔺 Qwen3.8-Omni-Flash фактически переносит архитектуру Flash-Next на значительно более широкий класс мультимодальных задач. Главное изменение заключается не просто в возможности загрузить аудио или видео, а в использовании этих данных непосредственно в ходе длительной агентной работы: модель может анализировать материал, выбирать необходимые фрагменты, вызывать инструменты и на основании результатов продолжать выполнение задачи.
Справочно. Контекст – до 1 млн токенов. Стоимость QwenCloud API составляет 0,15 доллара за 1 млн входных токенов, 0,47 доллара за 1 млн выходных и 0,016 доллара за 1 млн входных токенов из кэша. Открытые веса Qwen3.8-Omni-Flash не опубликованы; локально доступна родственная Qwen3.8-Flash-Next.
  • ❤ 1
More from @sof_news24
  1. Sep 29, 2026📻📡 OpenWrt + RTL-SDR: делаем из роутера удалённый радиоприёмник Обычный роутер с USB мож…
  2. Sep 29, 2026🇳🇴🛰 Новый начальник Разведывательной службы ВС Норвегии Генерал-лейтенант Ларс Сиверт Л…
  3. Sep 29, 2026🇪🇸⚔️ ССО Испании провели учение «Нептуно – 2026» В провинциях Аликанте и Кадис 7–20 сент…
  4. Sep 29, 2026🇺🇸⚙️ США: КССО разворачивает новый механизм ускоренных закупок вооружения и техники КССО…
  5. Sep 28, 2026🧭 Военный календарь на 29 сентября 2026 года Ежедневно – основные заранее объявленные мер…
  6. Sep 28, 2026🧭 Аналитический обзор основных военно-политических событий в Восточной Европе (по состоян…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →