🆕 Новая ИИ-модель DeepSeek V3.2-exp значительно улучшает работу с длинным контекстом, обеспечивая вдвое меньшую стоимость инференса и ускорение процессов.
🔍 Внедрённый механизм DeepSeek Sparse Attention (DSA) позволяет более эффективно выбирать важные фрагменты контекста, что повышает производительность модели в 2–3 раза и снижает потребление памяти на 30-40%. Она также демонстрирует незначительные различия в результатах по сравнению с предшественником, сохраняя качество обработки.
💡 Эта модель доступна для разработчиков на платформе Hugging Face, что позволяет проводить собственные тестирования и демонстрирует большие перспективы для проектов, связанных с длинными текстами.
Подробнее об этом можно узнать из статей на Hugging Face, TechCrunch и techstartups.com.
Post #2299
3.79K
- ❤ 6
- 👍 3
- 🤮 1