Сбер выкатил имбовую модель на сотни миллиардов параметров в опен-сорс. Разрабы использовали уникальную гибридную архитектуру MLA + GatedDeltaNet, которая выросла в коде, математике и агентных сценариях.
• GigaChat-3.5-Ultra-Instruct не уступает DeepSeek V3.2, но по размерам в полтора раза меньше.
• Модель стала соображать до 2,2 раза быстрее, а скорость работы под жесткой нагрузкой выросла на 20%.
• В нее теперь можно загрузить в два раза больше текста — памяти на контекст хватает с запасом.
• При этом аппетит к ресурсам у нее скромный: нагрузка на память снизилась примерно в четыре раза.
Полный разбор технологии читаем — тут.
А модель тестим здесь или здесь.
👍 Бэкдор
Post #1090
730

