Это очень важно знать для любой рп (даже не нa j.ai) и для экономии денег на платных прокси
Контекст — это рабочая память бота в токенах. Всё, что он одновременно «держит в голове», когда пишет очередное сообщение.💡 Простая аналогия
👉 Грубо говоря — память.
Главная проблема контекста в том, что он ограничен. Бот не помнит всего, как и люди.
Представьте, что вы разговариваете с человеком, у которого маленький блокнот. Он может записать в него только последние 10 фраз разговора, а всё, что было раньше, забывает. Контекст нейросети — это такой же ограниченный блокнот.📚 Из чего состоит контекст?
1. Системный промпт — ваша инструкция боту (личность, правила, стиль).
2. История сообщений — последние N сообщений (включая ваши и ответы бота).
3. Лорбук — дополнительная информация, которая добавилась по триггеру(бот не знает ее всегда,а только в нужный момент)
4. Информация о персонаже — из определения бота (те самые постоянные токены, что задаются при создании персонажа).
Всё это переводится в токены (1 токен ≈ 1–2 символа на английском и 3-4 символы на рус. Рус весит больше англ в 3-4 раза больше,потому что модели преимущественно учат на англ языке).
И общее число токенов не может превысить лимит модели.
🔢Как это работает
Допустим у вас 10к контекста. И есть бот на 7к токенов+ промт на 1к токенов. 10-(7+1к)=10-8=2к остаётся у вас на рп.
‼️Что происходит если модель превышает лимит?
Нет, рп не останавливается и бот не взрывается. Он просто начинает забывать старые детали. То есть ,то что было в начале.
• У бота как будто бы есть ящик,куда он складывает детальки рп. Когда место не остаётся,он вытаскивает какие-то кубики чтобы сложить новые
• Поэтому важно уметь пользоваться памятью (memory),чтобы какие-то детальки закрепить (то есть обозначить важное чтобы бот не забыл это)
↪️Вот гайд как пользоваться памятью
📏 Почему контекст ограничен?
У каждой модели есть свой «потолок»:
🔹 JLLM (стандартная модель Janitor AI) — около 9к токенов. Это очень мало. Бот забывает детали уже через 5–10 сообщений.
🔹 Хорошие прокси-модели (DeepSeek, Claude, GPT-4 и др.) — 32к, 64к, даже 128к токенов. Это уже длинные рп.
📌 Ограничение связано с вычислительной мощностью. Чем длиннее контекст, тем больше видеопамяти нужно, и тем медленнее и дороже генерация.
🧼 Как контекст влияет на РП
❌ С маленьким контекстом (4–9к) бот:
- Забывает, какую одежду вы надели в начале сцены.
- Перестаёт помнить, что вы уже познакомились.
- Повторяет одни и те же фразы.
- Может изменить характер героя, потому что «забыл» системный промпт.
✅ С большим контекстом (32к+) бот помнит:
- Детали разговора из прошлого часа переписки.
- Что вы сделали 50 сообщений назад.
- Имена второстепенных NPC, которые появлялись редко.
- События, которые развивались очень медленно.
💡 Важный совет
Экономить контекст очень важно.
Пихать в бота кучу мусора на 10к токенов, когда даже половина из них не нужна при обычной РП — это просто руинить себе игру. Именно поэтому советуют держаться 1,5-2к токенов у бота при его создании. И именно поэтому лучше писать бота на английском ,а не на русском чтобы бот меньше весил(потому что с английским у вас персоналити бота из 10к превращается магическим образом в 2к.)
🗂️ Собственно, поэтому и существуют лорбуки — весь мусор уходит туда.
Но даже с лорбуками важно не пихать всё подряд, а думать головой
Частые вопросы и частые заблуждения
1. Чем больше контекст тем лучше?
Нет. От большого количества деталей бота начинает мутить. Оптимальное количество контекста для рп 32к—64к. Миллион контекста вам не сдалось никак,эти гигантские цифры нужны для компаний
2. У меня бот больше 2к,его срочно надо сократить?
Нет. Бот может быть абсолютно любого количества по токенам. Все очень зависит от бота. Где-то достаточно 500 и он будет работать хорошо,где-то 1,5. Смотрите какая информация не нужна и ее можно убрать в лорбук.
Например: нужно ли знать боту о его семье когда вы деретесь в баре? Очевидно нет. Значит это идёт в лорбук. И далее по аналогии
#Гайд@janitorAiCF ⋮ @janitorAiCF ෆ
take bot→@SuggestionJAiCfBot