🇨🇳 DeepSeek прокачал логическое мышление ИИ и готовит громкий релиз!
Китайский AI-стартап DeepSeek в сотрудничестве с Университетом Цинхуа представил новую методику улучшения логики у LLM-моделей — комбинацию GRM (генеративное моделирование наград) и самокритичной настройки. Этот подход помогает моделям быстрее и точнее отвечать, ориентируясь на человеческие предпочтения. Результаты уже сравнимы с лучшими публичными решениями.
📂 Код обещают открыть, но сроки не объявлены.
Всё это происходит на фоне слухов о скором выходе DeepSeek-R2 — продолжения нашумевшей reasoning-модели R1, которую называли «тёмной лошадкой» на фоне гигантов индустрии.
🧠 Напомним:
— В марте обновили V3-модель с упором на логику и китайский язык
— В феврале открыли 5 репозиториев и опубликовали исследование по sparse attention
— Основатель DeepSeek — Лян Вэньфэн, финансируемый через свой хедж-фонд High-Flyer Quant
— Лян уже засветился на встрече с Си Цзиньпином как лидер прогрессивного китайского ИИ
Следим за ними — возможно, именно они зададут новый стандарт reasoning-моделей 💡
Если вы работаете с LLM и хотите быстро развернуть проект — используйте immers.cloud. Топовые GPU, настройка окружения и запуск модели занимают пару минут.
Post #558
1.07K

- 🔥 4
- 👏 4
- ❤🔥 2