TGViewer
КайфКодинг КайфКодинг @vibecodingartem · 1.02K subscribers
Post #219 420

Forwarded from from:adam

У Ленни вышла статья где рассказывается про то, почему AI продукты должны иметь другой цикл разработки. Авторы показали фреймворк CC/CD.

TLDR: как писал много раз ранее, rolling updates с эскалацией сложности системы и evals для оценки технического качества.

Две фундаментальные проблемы AI-продуктов:

1. Недетерминированность - пользователи пишут что угодно вместо нажатия строго определенных заранее кнопок, система отвечает по-разному на одинаковые запросы. Классический QA тут не работает.
2. Компромисс между агентностью и контролем - чем больше автономии даешь ИИ, тем меньше контроля остается у людей.

Что такое CC/CD:

Continuous Development:
- Разбиваем большую цель на версии с растущей автономией (v1: AI-раб → v3: AI-коллега)
- Настраиваем простейшее приложение с логированием всего подряд и возможностью передачи контроля человеку
- Проектируем evals для измерения качества

Continuous Calibration:
- Запускаем на небольшой группе пользователей
- Анализируем реальные данные и паттерны фейлов
- Итеративно фиксим на основе данных

Пример из жизни - автоматизация саппорта:
- v1: Только роутинг тикетов по отделам
- v2: Предложение решений на основе инструкций и/или базы знаний
- v3: Автономное решение с эскалацией сложных кейсов до человека

Главный принцип - не давать ИИ полную автономию сразу. Система должна заслужить доверие через постепенное увеличение ответственности и доказательство надежности на каждом этапе. Это как онбординг нового сотрудника. Сначала простые задачи, потом постепенное расширение полномочий по мере накопления доверия.

По факту, это формализация того, что мы и так делаем в команде с нашими ассистентами и другими ИИ продуктами. Начинаем с простых сценариев, постепенно расширяем полномочия, мониторим каждый чих через evals, много бенчмаркинга.
Lennysnewsletter Why your AI product needs a different development lifecycle Introducing the Continuous Calibration/Continuous Development (CC/CD) framework
  • ❤ 2
More from @vibecodingartem
  1. Oct 2, 2026Детектор «нерфа» Opus 5.5 на собственной проверке не отличил Opus 5.5 от подставленного вм…
  2. Oct 2, 2026Примерно на половину вопросов, которые Шон Гёдеке задаёт агенту, он получает ответ, которы…
  3. Oct 2, 2026В Zapier сотрудников оценивают по рубрике AI-навыков — и CEO компании Уэйд Фостер говорит,…
  4. Oct 2, 2026Sonnet 5.5 на максимальном effort обходится дороже, чем Opus 5.5 на максимальном, — хотя т…
  5. Oct 2, 2026Сносное разовое решение агента не остаётся разовым. Следующие агенты берут его за образец.…
  6. Oct 2, 2026Открытый протокол не делает сервер открытым: к удалённому MCP-серверу Figma подключится то…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →