🤖 Как AI-агент тихо выбирает за тебя зависимости
Ты спрашиваешь агента: «какую библиотеку использовать под фича-флаги?».
Получаешь уверенный ответ с обоснованием и сразу идёшь пилить.
Кажется, что за тебя провели ресёрч и что именно этот вариант подобран под твой кейс.
Но на самом деле нейросеть выбрала архитектурное решение — а ты даже не заметил, что размышления не было.
📊 Что показывают цифры На llmrank.fyi каждый месяц гоняют одни и те же промпты через Claude, ChatGPT и Gemini и смотрят, что те советуют.
Картина такая: — Каждая модель называет один и тот же топ-вариант в 97–99% случаев.
Выглядит как устоявшийся консенсус — Но между собой три модели сходятся в топ-3 только в 58% случаев.
В 42% сценариев стоило спросить вторую модель — и она указала бы на другое решение. Консенсуса нет.
Есть три уверенных монолога, которые друг с другом не согласны.
🔍 Пример — Фича-флаги:
LaunchDarkly доминирует у всех, но Split.io всегда по-разному, а ChatGPT его вообще не упоминает.
Альтернативы AWS: ChatGPT в 100% случаев выдаёт Azure, а Gemini её не включает ни разу.
Одна и та же задача, разные модели — разный «очевидный» выбор.
🕵️ В чём настоящая ловушка
Опасность не в том, что совет плохой.
Опасность в том, что уверенность маскирует разногласие.
Детерминированный, гладкий ответ читается как результат исследования — а это всего лишь один предвзятый сэмпл с капелькой уверенности
И мы просматриваем план внедрения ровно с тем же ленивым доверием, с каким апрувим чужой PR по диагонали.
Раньше выбор зависимости — это был ресёрч, обсуждение в команде, проверка лицензии, иногда целый RFC.
Теперь дефолтный флоу: спросил агента → получил ответ → начал пилить.
Этап, где решение вообще осмыслялось, просто выпал.
🧭 Что с этим делать
Не «взять то, за что проголосовало большинство моделей».
Само разногласие — это сигнал.
Сходятся три модели — риск низкий.
Разошлись — это не шум, который надо усреднить, это флаг: вот здесь настоящая точка выбора, и тут нужен человек, который реально разберётся.
И скорее всего это не только про зависимости.
Так же уверенно агент подаёт и другие архитектурные решения — с доверием, которого он не заслужил.
А вы проверяете, что советует агент, второй моделью — или сразу пилите? 🤔
#ai #agents #architecture #programming #webdev #discussion
Post #1515
116
- ❤ 1