Кажется, мы неправильно представляли себе будущее ИИ-агентов.
Не одна огромная модель будет думать над каждым чихом. Скорее наоборот: дорогую LLM будут звать только туда, где действительно нужно думать, а сотни мелких решений отдадут быстрым специализированным моделям.
И Jev уже начинают проверять именно в таких сценариях.
Например, ему дали Minecraft. Каждые ~600 мс модель получает состояние мира: здоровье, голод, врагов рядом, позицию и текущую цель — и решает, что делать дальше: драться, убегать, есть или продолжать задачу. Причём несколько таких решений она принимает параллельно за один вызов.
Есть похожие эксперименты с Doom: вместо длинных рассуждений модель несколько раз в секунду выбирает буквально одно действие - влево, вправо, стрелять, искать аптечку. Это уже гораздо ближе к реальному управлению системой, где ответ нужен сейчас, а не через 10 секунд после красивого chain-of-thought.
Появились и браузерные агенты, Minecraft-моды, шахматы, 2048, NPC и даже футбольный матч, где каждый из 22 игроков управляется отдельным Jev.
И вот тут идея становится понятнее.
Большая LLM может сказать:
«Нужно добыть ресурсы, построить укрытие и пережить ночь».
А дальше Jev сотни раз решает:
бежать или драться?
есть сейчас или потом?
куда повернуть?
продолжать цель или реагировать на угрозу?
То есть архитектура постепенно становится такой:
LLM планирует → Jev принимает быстрые локальные решения → обычный код исполняет.
И мне кажется, именно это сейчас самое интересное в Jev. Своего рода попытка сделать рефлексы для ИИ-агентов.
Post #454
407
- 👍 4
- 🔥 3
- 👏 2
- ❤ 1