Reasoning Lock: ИИ-агент в проде тратит токены и молчит — живой разбор бага
В прошлой статье автор рассказывал о скрытом баге: ИИ-агент в проде заказчика тратит токены, генерация закрывается со статусом «успех», а клиенту уезжает пустая строка. Обещание разобраться и починить выполнено: причина найдена, правки встали в воркфлоу, счётчик пустых ответов уже 7 дней — чисто. Баг получил имя Reasoning Lock. Агент работает на self-hosted n8n: по ночам принимает заявки в Instagram Direct, ведёт диалог, собирает анкету и создаёт/обновляет сделку в amoCRM. Стек: n8n + Redis + LangChain, основная LLM — DeepSeek V4 Pro через OpenRouter, резервная — недавно поменяна на Qwen3.8 Flash.
История началась задолго до самого бага: с конца июня отказы шли двумя периодами, и разница между ними — ключ к пониманию. Первый период — тесты и запуск, природа инфраструктурная: ограничения Meta — потери вебхуков, окно ответов, двойные доставки; чинилось мгновенным 200 OK, буфером на Redis и дебаунсом. К продакшену этот класс закрыли.
Второй период — последние два месяца: промпт. Правки от заказчика посыпались в системный промпт под живую бизнес-логику: инструкция по пересылке оплаты пользователем, отдельные сценарии ответов для VIP-клиентов, уточнения формулировок после каждого спорного диалога. Каждая правка по отдельности правильная и рабочая, но суммарно промпт разросся примерно до 6.4k токенов, а плотность запретов («КАТЕГОРИЧЕСКИ ЗАПРЕЩЕНО», «Отправь СТРОГО этот текст») стала максимальной за всю жизнь системы.
Читать далее
👉 Telegram | Max
Post #5917
1.2K

- 👎 1