Решающие модели (System 1) #decision #rlcd
huggingface.co/orcarouter/OrcaSAQ-2-27B - OrcaSAQ2 27B: высокоточный reasoning в файле 12.3GB
huggingface.co/orcarouter/OrcaSAQ-2-Cyber-27B-Uncensored-GGUF - OrcaSAQ2 Cyber: без цензуры, 15.7GB
huggingface.co/akhilaaa3/Jev-Omni - Jev-Omni: решения по тексту, картинкам, аудио и видео разом
huggingface.co/fastino/GLiNER2.5-Decide - GLiNER2.5-Decide: оценка любого набора меток за один проход, без генерации токенов
huggingface.co/SupersonicLabs/Julia-1 - Julia 1: 144M параметров, контекст → чёткие решения
huggingface.co/Contrastive-LM/CLM-v0.1-8B - CLM-v0.1-8B: вместо медленных верификаторов — эмбеддинги состояний и действий
Скорость и кванты #optimization #gguf #dflash
huggingface.co/harshatheg/Qwen-2.5-1B-RLCD - RLCD: извлекает структурированные данные в 7 раз быстрее на Apple Silicon
huggingface.co/z-lab/Qwen3.8-27B-DFlash2 - Qwen3.8-27B DFlash2: ускоренная генерация (drafter-модель)
huggingface.co/sirus/Qwen3.8-27B-heretic-ara-MXFP6-MXFP8-DFlash2-GGUF - новый формат кванта MXFP6/MXFP8 + DFlash2: быстрее инференс
huggingface.co/Edge0/Edge0-35B-A3B-preview - Edge0-35B-A3B: модель «телефонного» класса, работает в 3 GiB памяти
Агенты и инструменты #agent #toolcalling
huggingface.co/XingChen-AGI/Xing4.0-29B-A4B - Xing4.0-29B-A4B: агентные задачи на Ascend NPU, контекст 256K
huggingface.co/TokenRhythm/NeoHorse-1-4B - NeoHorse-1-4B: роутинг-обвязка, прокачивает Qwen3.5-4B
huggingface.co/apodex/Apodex-1.1-mini-GGUF - Apodex-1.1-mini: агентные задачи по файлам и данным
huggingface.co/nex-agi/Nex-N2.5-Pro - Nex-N2.5-Pro: агент для кодинга и работы с компьютером
huggingface.co/nex-agi/Nex-N2.5-mini - Nex-N2.5-mini: длинные агентские задачи с vision-обратной связью
github.com/ortegaalfredo/ngram-knowledge-injector - инжектор фактов в память Qwen3.8 через n-gram
huggingface.co/TheOneWhoWill/Coding-Monkey-Gemma-GGUF - Coding-Monkey: локальная модель с сильными тул-коллами
huggingface.co/pipecat-ai/phonellm-alpha-1 - phonellm: держит телефонных агентов в рамках диалога
Мультимодальность и контекст #multimodal
huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp - DeepSeek-V4-Flash Vision Exp: экспериментальный мультимодальный вариант
huggingface.co/Agnes-AI/Agnes-2.5-Pro-Alpha - Agnes-2.5-Pro: рассуждения на миллион токенов
github.com/QLNI/SHADOW-250M-Instruct - SHADOW-250M: архив 100M токенов ужат до 60MB файла
Код и всякое #coding
huggingface.co/ornith-ai/Ornith-1.5-9B - Ornith-1.5-9B: #reasoning и кодинг на одной GPU
huggingface.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF - Ornith-1.5-35B-A3B: GGUF под локальных кодинг-агентов
huggingface.co/openbmb/MiniCPM5-2B - MiniCPM5-2B: карманная модель, кодит и рассуждает
huggingface.co/IFM/K2-Horizon-MoVA-36B-A4B - K2-Horizon-MoVA: 36B всего, активно 4B
huggingface.co/XHToken/Spark-X2.5-4B - Spark-X2.5-4B: компактная универсальная 4B (гибридное внимание, 1M контекст) #compact
huggingface.co/thesysdev/OUI-1 - OUI-1: диффузионная генерация UI-экранов за ~секунду #gui
huggingface.co/LessThanThreeAI/Qwen3.8-27B-Humanlike-Chat-GGUF - Humanlike-Chat: живой, реалистичный ролеплей
huggingface.co/TheDrummer/Artemis-31B-v1.1 - Artemis-31B: креативное мышление поверх Gemma 4 Chat
huggingface.co/OBLITERATUS/Qwen3.8-27B-OBLITERATED - Qwen3.8 27B полностью без цензуры #uncensored
huggingface.co/superwhisper/s1-mini - S1-mini: превращает неразборчивую речь в текст #ASR
Post #14915
855