Alibaba выпустила Qwen3.5-Omni — модель, которая обрабатывает текст, изображения, аудио и видео как единый поток. Она обходит Gemini 3.1 Pro на 215 аудиобенчмарках, а также неожиданно научилась писать код по голосовым командам и видеороликам без целенаправленного обучения. Распознавание речи расширено с 11 до 74 языков, контекст вырос до 256 000 токенов. Веса модели пока не опубликованы, доступ предоставляется исключительно через API.
Читать полностью
——————
Подпишись, потом забудешь!
https://vk.com/chernovdev / https://t.me/chernovdev
https://chernovdev.ru
Post #2064
574
