TGViewer
STARTOBUS STARTOBUS @startobus · 2.42K subscribers
Post #6474 414
Alibaba выпустила Qwen3.5-Omni — мультимодальный ИИ, который слышит, видит и говорит

Alibaba выпустила Qwen3.5-Omni — модель, которая понимает текст, изображения, аудио и видео одновременно, а отвечать может как текстом, так и синтезированной речью. Обучена на 100+ млн часов аудиовизуальных данных, поддерживает контекст на 10 часов аудио или 400 секунд видео за раз.

По бенчмаркам на аудио и видео Plus-версия превосходит Gemini 3.1 Pro. Есть занятная фича: показываешь рукописную схему, голосом объясняешь задачу — модель пишет код. Три версии (Plus/Flash/Light) доступны через Alibaba Cloud API уже сейчас.

🔗 Читать: https://mltimes.ai/alibaba-vypustila-qwen3-5-omni-multimodalnyy-ii-kotoryy-slys/
More from @startobus
  1. Oct 7, 2026У consumer AI еще полно незанятых ниш A16Z сравнил крупнейшие категории эпохи Web 1.0/2.0…
  2. Sep 29, 2026Google представила говорящих ИИ-персонажей Они видят, слышат собеседника и отвечают в реал…
  3. Sep 28, 2026ElevenLabs выпустили Eleven v4 и v4 Turbo: модели озвучки с точным управлением эмоциями, т…
  4. Sep 28, 2026Раньше будущее было лучше. По крайней мере, прогнозы о нём мне нравились больше. Сейчас чи…
  5. Sep 22, 2026Xiaomi выпустила MiMo V2.6 Pro и Flash с открытыми весами Pro — топ-1 в Artificial Analysi…
  6. Sep 19, 2026Тут господа из Devin.ai (ex Windsurf) сделали знатный подгон халявы страждущим любителям в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →