- Внедряю AI в продукты банка с 20+ млн пользователей
- Показываю, как встроить AI в работу
- Держу ферму агентов 24/7
Post #169
146

AI забывает постоянно все, а ты тратишь время на то, чтобы еще раз обьяснить ему контекст, больно да? Мне было
Проблема
У AI, как и у человека, память устроена так, чтобы оставлять важное и забывать старое - чтобы не перегружаться.
Наглядный пример: я учу английский полгода, и чтобы управлять своим мозгом и его воспоминаниями, повторяю конструкции через интервалы. Тебе показывается фраза, ты пытаешься вспомнить - долго думал? Значит, нужно повторить через 5 дней.
У Claude окно контекста больше, чем у большинства конкурентов, но он всё равно конечное. Ты раз за разом повторяешь контекст, накапливаются противоречие между старыми и новыми решениями, устаревшие версии текста конкурируют с актуальной. Добавь сюда галлюцинации и итерационный процесс - вот и сказка.
Что входит в окно?
1 токен ≈ 4 символа ≈ 0,75 слова.
Стандартное окно контекста Claude - 200 тысяч токенов. Отсюда:
- Английский текст: около 150 тысяч слов, примерно 500 страниц
- Русский текст: токенизируется хуже, на токен приходится в среднем 2,5-3 символа. Выходит порядка 500-600 тысяч символов, около 280-330 стандартных страниц (по 1800 знаков)
- Код: примерно 10-13 токенов на строку, то есть порядка 15-20 тысяч строк
- PDF и изображения через API: до 100 страниц в запросе на стандартном окне, до 600 - если включён расширенный режим на 1 млн токенов (доступен для отдельных моделей через API, не в обычном чате)
Что делать?
• Для агентов использую Obsidian - у них прописаны правила, обновление файла в заметках с текущим статусом
• Для чатов использую Projects с прикреплёнными файлами и распределением контекста между чатами: прошу в каждом чате Summary для переноса, он формирует файл, ты добавляешь его в Projects - и при переходе между чатами проект хранит актуальный контекст. В новом чате можно сразу спросить, владеет ли он актуальным контекстом.
Проблема
У AI, как и у человека, память устроена так, чтобы оставлять важное и забывать старое - чтобы не перегружаться.
Наглядный пример: я учу английский полгода, и чтобы управлять своим мозгом и его воспоминаниями, повторяю конструкции через интервалы. Тебе показывается фраза, ты пытаешься вспомнить - долго думал? Значит, нужно повторить через 5 дней.
У Claude окно контекста больше, чем у большинства конкурентов, но он всё равно конечное. Ты раз за разом повторяешь контекст, накапливаются противоречие между старыми и новыми решениями, устаревшие версии текста конкурируют с актуальной. Добавь сюда галлюцинации и итерационный процесс - вот и сказка.
Что входит в окно?
1 токен ≈ 4 символа ≈ 0,75 слова.
Стандартное окно контекста Claude - 200 тысяч токенов. Отсюда:
- Английский текст: около 150 тысяч слов, примерно 500 страниц
- Русский текст: токенизируется хуже, на токен приходится в среднем 2,5-3 символа. Выходит порядка 500-600 тысяч символов, около 280-330 стандартных страниц (по 1800 знаков)
- Код: примерно 10-13 токенов на строку, то есть порядка 15-20 тысяч строк
- PDF и изображения через API: до 100 страниц в запросе на стандартном окне, до 600 - если включён расширенный режим на 1 млн токенов (доступен для отдельных моделей через API, не в обычном чате)
Что делать?
• Для агентов использую Obsidian - у них прописаны правила, обновление файла в заметках с текущим статусом
• Для чатов использую Projects с прикреплёнными файлами и распределением контекста между чатами: прошу в каждом чате Summary для переноса, он формирует файл, ты добавляешь его в Projects - и при переходе между чатами проект хранит актуальный контекст. В новом чате можно сразу спросить, владеет ли он актуальным контекстом.
- ❤ 3







