Утренний дайджест AI новостей с GitHub, Reddit и Hugging Face:
Codex Autoresearch Skill
Самоуправляемая итеративная система для Codex, которая непрерывно модифицирует и проверяет код. Инструмент вдохновлен концепцией авто-исследований Андрея Карпати.
Qianfan-OCR
Модель распознавания документов на 4 млрд параметров от команды Baidu Qianfan. Работает по принципу end-to-end для интеллектуальной обработки текстовой информации.
Анонс MiniMax-M2.7
Представлена новая языковая модель на базе Llama, предназначенная для локального развертывания.
Обсуждение востребованности новых моделей Mistral
В сообществе обсуждают низкую популярность последних релизов Mistral. Многие отмечают, что Mistral Nemo остается наиболее удачной версией в линейке.
7/24 Office
Система саморазвивающихся ИИ-агентов с поддержкой 26 инструментов, MCP-плагинов и трехуровневой памяти. Проект написан на чистом Python и предназначен для работы в режиме 24/7.
llm-circuit-finder
Метод дублирования специфических слоев в Qwen2.5-32B и Devstral-24B, который значительно повышает навыки рассуждения. Улучшение логики достигается без дообучения или изменения весов модели.
Выбор моделей для системы с 282 ГБ VRAM
Обсуждение наиболее производительных LLM для сервера с двумя NVIDIA H200. Основные задачи включают автодополнение кода в IDE и эксперименты с ИИ-агентами.
X-Dub
Инструмент от KlingAI для синхронизации губ персонажа на видео с любым аудиофайлом. Метод использует генеративный подход для качественного визуального дубляжа без использования масок.
video_to_world
Метод реконструкции 3D-сцен на основе диффузионных видеомоделей. Система решает проблему пространственной несогласованности кадров с помощью нежесткого выравнивания.
Семейство моделей Omni в формате GGUF
Выпуск моделей OmniClaw и Omnicoder на базе Qwen 9B без цензуры. Веса получены путем дистилляции из Claude Opus для эффективной работы над кодом и текстами на слабом железе.
Post #396
623