⚡️ funes: память для coding-агентов, собранная из их же сессионных трейсов
Hugging Face выложила funes — слой памяти для coding-агентов, который строится из сессий, уже лежащих у вас на диске. Поддержаны Claude Code, Codex, pi и Hermes.
Идея простая: агент во время работы уже пишет плотный отчёт о том, что он пробовал, где ошибся и почему передумал. Но грепом по десяти тысячам ходов вопрос «почему мы ушли от стримингового парсера» не решается. funes парсит трейсы в единую форму, чанкует, эмбеддит локальной моделью и пишет в датасет Lance. Запрос — это вектор плюс BM25, слияние рангов, реранкер на кросс-энкодере, перевзвешивание по свежести и добор соседних чанков. Ставится одним бинарником, подключается командой funes add claude, после чего у агента появляются инструменты recall и get, а каждый завершённый ход индексируется автоматически. recall возвращает исходный текст, а не пересказ, и показывает агента, сессию, ход и время.
Память можно привязать к приватному датасету на Hub, тогда она переезжает между машинами и агентами: решение, принятое в Claude Code, вспоминается в Codex. Credentials вырезаются при индексации и проверяются ещё раз при публикации.
На бенчмарке handoff-vs-recall выигрыш не только в удобстве: recall оказался в 8 и в 4 раза дешевле написанного вручную хэндоффа на двух задачах, а компакция на одной из них просто потеряла нужные находки при суммаризации. В комментариях к анонсу есть и независимый замер на 19 тысячах реальных сессий, там hit@1 составил 9 из 100 на дефолтах и 19 из 100 с отключённым 30-дневным half-life — стоит иметь в виду, если ваша история старше месяца.
👉🏻 Канал | 💬 Чат | 📕 Каталог
Post #561
136