Доверяй, но проверяй.
Я сейчас в основном работаю в Claude code в нативном приложении Claude Desktop - перешел в него из терминала, поскольку оно все больше и больше становится приспособленным для вайбкодинга. В нем я подключил другие модели - GLM, DeepSeek, Qwen, GPT. У всех для этого есть официальные установки. Удобно - просто просишь клода запустить субагента на GPT (можно указать и модель, и уровень усилий), и он вызывает его сам, в этой же сессии. Очень активно этим пользуюсь при тестировании результатов - исхожу из того, что модели с другой архитектурой будут находить ошибки, которых не видит проверяющий с той же архитектурой, что и кодировщик.
Сегодня решил провести исследование результатов работы агентов - запустил Клода анализировать сессии за последний месяй. И что вы думаете - эта сволочь выдает мне, что в основном он другие модели не запускал. Просто передавал работу Sonnet 5. Статистика примерно такая - реальному GPT передавалось около 45% запросов, DeepSeek - 15%, GLM - менее 10%. Жесть. Слов нет. При этом никаких сообщений, он даже оценивал работу моделек, имитировал работу в мультиагентной среде, чтобы мне понравилось.
Видимо, надо как-то более жестко встраивать вызов других моделей в команды и хуки, просто с голоса - недостаточно.
Post #1553
46