DeepSeek V3.2 против GPT-5
Пока Кремниевая долина меряется капитализацией, китайская лаборатория DeepSeek выкатила обновление, которое выглядит как прямая угроза гегемонии OpenAI. Встречайте: DeepSeek-V3.2 и её заряженная версия V3.2-Speciale.
Инженеры пересобрали механизм внимания (Attention). Главная боль многих LLM — деградация качества на длинных контекстах («забывание» начала промпта) — здесь, по заверениям авторов, решена. Модель эффективно «переваривает» огромные массивы данных, не теряя нить рассуждения.
Заявки у DeepSeek, мягко говоря, дерзкие. Согласно их внутренним бенчмаркам, Speciale превосходит GPT-5 в ряде метрик и стоит вровень с Gemini-3.0 Pro по качеству логических рассуждений (Reasoning).
Конечно, к вендорским графикам всегда стоит относиться со здоровым инженерным скепсисом — мы все знаем, как маркетологи любят выбирать «удобные» тесты. Но учитывая успехи предыдущих версий DeepSeek (особенно в кодинге), игнорировать релиз нельзя. Если независимые тесты подтвердят хотя бы половину, монополия США на SOTA-модели снова под вопросом. Ждем веса на HuggingFace?
Post #44
55
