Утренняя сводка из мира AI:
Yao Open Prompts: открытая библиотека промптов на китайском
База промптов для различных сценариев, включая работу, учебу, маркетинг и повседневную жизнь.
TokenSpeed: высокоскоростной движок для инференса LLM
Оптимизированное решение для максимально быстрого инференса больших языковых моделей.
Инструмент для восстановления паролей криптокошельков Ethereum
Многопоточная утилита для восстановления паролей к keystore-файлам v3 с использованием методов brute-force и словарей.
Ускорение Qwen 3.6 27B в 2,5 раза с помощью MTP
Специальная сборка llama.cpp обеспечивает инференс Qwen 3.6 27B в 2,5 раза быстрее с контекстным окном 262k токенов на 48 ГБ VRAM.
Сравнение стоимости использования DeepSeek V4 и локальных решений
Анализ показывает значительную экономию при использовании DeepSeek V4 по сравнению с облачными сервисами и локальным запуском моделей.
ZAYA1-8B: компактная модель архитектуры Mixture of Experts
Новая языковая модель с 760 миллионами активных параметров, построенная на базе архитектуры MoE.
Внимание: вредоносное ПО в репозитории Open-OSS/privacy-filter
Пользователей предупреждают о наличии вредоносного кода в проекте privacy-filter от Open-OSS.
Сравнение качества квантования Qwen 3.6 27B
Детальный бенчмарк различных методов квантования (BF16, Q8_0, Q4_K_XL и другие) для модели Qwen 3.6 27B.
Apple сокращает выбор конфигураций Mac Studio с большим объемом памяти
Изменения в линейке Mac Studio ограничивают доступность моделей с максимальным объемом памяти, необходимым для запуска тяжелых LLM.
CodexSaver: оптимизация затрат на Codex с помощью DeepSeek
Инструмент позволяет снизить расходы на использование Codex без потери качества генерации за счет интеграции с DeepSeek.
Post #577
722