Утренний дайджест AI новостей с GitHub, Reddit и Hugging Face:
Codex Autoresearch SkillСамоуправляемая итеративная система для Codex, которая непрерывно модифицирует и проверяет код. Инструмент вдохновлен концепцией авто-исследований Андрея Карпати.
Qianfan-OCRМодель распознавания документов на 4 млрд параметров от команды Baidu Qianfan. Работает по принципу end-to-end для интеллектуальной обработки текстовой информации.
Анонс MiniMax-M2.7Представлена новая языковая модель на базе Llama, предназначенная для локального развертывания.
Обсуждение востребованности новых моделей MistralВ сообществе обсуждают низкую популярность последних релизов Mistral. Многие отмечают, что Mistral Nemo остается наиболее удачной версией в линейке.
7/24 OfficeСистема саморазвивающихся ИИ-агентов с поддержкой 26 инструментов, MCP-плагинов и трехуровневой памяти. Проект написан на чистом Python и предназначен для работы в режиме 24/7.
llm-circuit-finderМетод дублирования специфических слоев в Qwen2.5-32B и Devstral-24B, который значительно повышает навыки рассуждения. Улучшение логики достигается без дообучения или изменения весов модели.
Выбор моделей для системы с 282 ГБ VRAMОбсуждение наиболее производительных LLM для сервера с двумя NVIDIA H200. Основные задачи включают автодополнение кода в IDE и эксперименты с ИИ-агентами.
X-DubИнструмент от KlingAI для синхронизации губ персонажа на видео с любым аудиофайлом. Метод использует генеративный подход для качественного визуального дубляжа без использования масок.
video_to_worldМетод реконструкции 3D-сцен на основе диффузионных видеомоделей. Система решает проблему пространственной несогласованности кадров с помощью нежесткого выравнивания.
Семейство моделей Omni в формате GGUFВыпуск моделей OmniClaw и Omnicoder на базе Qwen 9B без цензуры. Веса получены путем дистилляции из Claude Opus для эффективной работы над кодом и текстами на слабом железе.