Появился Hyper-Extract — инструмент, который превращает неструктурированные документы в полноценные базы знаний.
Вместо обычного разбиения PDF на чанки для RAG, Hyper-Extract может автоматически строить графы знаний, гиперграфы, временные и пространственные графы, типизированные модели данных, Obsidian Vault и базы знаний с поддержкой MCP.
Среди сценариев использования:
• преобразование научных статей в исследовательские графы;
• извлечение компаний, людей, метрик и рисков из финансовых отчётов;
• создание поисковых баз знаний из внутренних документов;
• локальный запуск через vLLM без отправки данных в облако;
• подключение к Claude Desktop и агентам в IDE через MCP.
В комплекте также есть более 80 YAML-шаблонов для финансов, юриспруденции, медицины и других областей.
GitHub: https://github.com/yifanfeng97/Hyper-Extract
👉 @PythonPortal
Post #5916
5.17K