LiquidAI LFM2.5-8B-A1B, выложили 3 часа назад — гибрид из 18 double-gated LIV-конволюций и 6 GQA-слоёв. 8,3B параметров всего, активных 1,5B, контекст 131 072 токена, 9 языков. Обучена на 38 триллионах токенов с RL и reasoning-тюнингом. Из бенчмарков:
— обходит gpt-oss-20B (21B / 3,6B активных) на IFEval (91,84 против 86,73), Multi-IF и AA-Omni Non-Hallucination Rate (63,47 против 24,50);
— паритет с Qwen3-30B-A3B-Thinking на MATH500, проигрывает на AIME25/26 и BFCLv3;
— поддержка GGUF, MLX, ONNX, llama.cpp, vLLM и SGLang — день в день с релизом.
OpenBMB MiniCPM5-1B — обычная LlamaForCausalLM, 1,08B параметров, 24 слоя, GQA 16/2, контекст 131 072 токена. Один чекпоинт работает в двух режимах через шаблон
<think>: быстрый ассистент или обдумывающий режим с явной цепочкой рассуждений. Пайплайн обучения: pre-training, потом SFT, затем RL и Online Preference Distillation. Авторы заявляют SOTA в 1B-классе по tool use, генерации кода и сложному reasoning против Qwen3-0.6B/think и LFM2.5-1.2B-Thinking. Есть готовые сборки под llama.cpp (GGUF) и Apple Silicon (MLX, в том числе 4-битная).@neuro_channel (теперь ещё в VK и Max)
