TGViewer
NOP::Nuances of Programming NOP::Nuances of Programming @nuancesprog · 56.4K subscribers
Post #8047 2.23K
Три страховки от тихих сбоев LLM-пайплайна

Модель, которая деградировала, отдаёт тот же JSON и те же 200 OK. Мониторинг зелёный, а очередь на модерацию полна мусора.

Автор напоминает: в 2025-м 42% компаний свернули большинство своих AI-инициатив. Обычные сигналы отказа — таймауты, стектрейсы, скачки p99 — тут просто не срабатывают.

Три меры: golden set как обычный тест по расписанию, PSI по входным данным и явный ответ «отдать человеку». Спорный момент — концовка превращается в рекламу библиотеки для лимита трат.

🔗 Подробнее

@nuancesprog #AI #Python
  • 👍 4
More from @nuancesprog
  1. Sep 28, 2026LuaRocks.org взломали через байткод LuaJIT С 9 июля по 20 августа атакующие выполняли кома…
  2. Sep 28, 2026DeepSeek показала свою песочницу для обучения агентов DeepSeek опубликовала статью о DSec…
  3. Sep 28, 2026localStorage блокирует главный поток Автосохранение черновика в localStorage подвешивает с…
  4. Sep 28, 2026Сообщение в чате Twitch превратилось в выполнение кода на ПК стримера Исследователь нашёл…
  5. Sep 28, 2026Бенчмарк, где инструменты врут агенту Разработчик собрал Sabotaged Tools — набор из шести…
  6. Sep 27, 2026Как 700 агентов OpenAI взломали Hugging Face Исследователи восстановили 80 000 payload'ов…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →