🛠 В боте Claude ИИ-маркеры чистят кодом, не промптом
Автор Telegram-бота для сценариев из голосовых сообщений проверил три слоя борьбы с «нейросетевым» стилем: правила в промпте, второй проход Claude и регулярки. Первый слой срывался на длинных текстах, второй ловил антитезы, но мог пропустить тире или изменить разметку.
Поэтому символы тире — пять вариантов, включая длинное и среднее, — заменяются обычным дефисом детерминированно. Антитезы вроде «не X, а Y» регулярка только обнаруживает: переписывает их модель, потому что автоматическая замена может сломать смысл. Если второй проход недоступен, бот всё равно отдаёт текст с очищенными тире.
В пайплайне используются Whisper large-v3-turbo через Groq и Claude Sonnet 4.6; второй проход настроен на температуру 0,2. Автор пишет, что сделал три слоя за один день, 7 июня, а после поломки бота при пересборке в сентябре ограничил версию SDK anthropic диапазоном 1.x. В статье на Habr есть код фильтра и важная оговорка: второй проход пока не проверяет, сохранила ли модель структуру текста.
Я бы не считал «человеческий стиль» измеримой целью, пока команда не определила, какие именно маркеры мешают читателю. Но проверяемые ограничения — символы, формат и целостность блоков — стоит закрывать кодом: повторный вызов модели добавляет цену и ещё одну возможность испортить результат.
#Claude #TelegramБот #РегулярныеВыражения #ПромптИнжиниринг
Post #327
3