Раз в неделю кто-то спрашивает, на какой ИИ подсесть. Покажу свой стек с цифрами и объясню, почему именно так.
Что у меня и почём
🔸 $200/мес — Claude Max. Сижу в Claude Code (это терминальный агент — модель сама читает файлы, запускает команды, проверяет результат) часами каждый день: рефакторинги, длинные сессии, агенты, кодовая база целиком в контексте. Лимиты дешёвых тарифов выжирал за пару часов. Вам $200 не нужно. Если задача — «пара скриптов в неделю», хватит Pro за $20. Если работаете каждый день, но не живёте в терминале — $100 Max золотая середина.
🔸 $20/мес — ChatGPT Plus (мне сейчас вообще бесплатно дали, забавно). Использую ровно под одно — генерация картинок для канала. Сиба-ину сверху — оттуда. Для кода и анализа не открываю: Claude закрывает.
🔸 $0 — DeepSeek, Gemini. Захожу раз в пару недель проверить, не догнали ли. В агентных сценариях пока не вывозят. На разовую задачу или простой код — норм, но платить за подписку не вижу смысла.
🔸 $0 — локальный Qwen3.5 9B (раньше была Gemma3 12b). Стоит на десктопе с RTX 5070 Ti (16 GB VRAM) и на Маке с 24 GB unified memory. Включаю, когда работаю с тем, что нельзя отдавать в облако. К локалкам подготовлен по обоим фронтам.
Почему такая раскладка
Главный тейк: платить параллельно за Claude и ChatGPT как за «универсальные ИИ» — это переплата. Большинство берёт ChatGPT Plus, потому что «все так», и Claude даже не пробует. И продолжает мучиться с агентами, которые слабее.
Если Claude вывозит код и длинные тексты — второй универсальный ИИ нужен только под то, чего у Claude нет: картинки, голос, конкретные интеграции.
Локалка — две оговорки
🔸 Видеокарта или Mac. На 8 GB VRAM (это память на видеокарте, не оперативка) тоже можно — поедут совсем маленькие модели, но контекст (сколько модель помнит за раз) скромный и агентные штуки спотыкаются. На моих 16 GB на RTX и 24 GB на Маке небольшие модельки крутятся прилично — для автокомплита и Q&A по коду хватает. Чем больше памяти — тем больше параметров и контекста влезает. Mac с unified memory тут даже удобнее: одна шина, не надо отдельно следить за GPU-памятью.
🔸 Агенты. Локалки в 2026 пока не вывозят длинные цепочки с инструментами так же ровно, как облачные. Это не «вместо Claude», а «когда Claude нельзя».
Как поставить локалку
🔸
Ollama — ollama run qwen3:8b, и всё. Для тех, кто живёт в терминале.🔸
LM Studio — графический интерфейс, удобно тыкать модели мышкой и смотреть, сколько съедает VRAM.🔸
llama.cpp напрямую — если хочется крутить каждую настройку руками.Если коротко
🔸 Работаете в коде каждый день и много → Claude Code ($20–200 по нагрузке)
🔸 Только текст, картинки, чат → ChatGPT Plus хватит
🔸 Корп-код / параноите → локалка на 16 GB
🔸 Платить за Claude и ChatGPT как за два мозга — переплата
Выбирайте хорошее дерьмо. Плохое не выбирайте.
А вы сколько в месяц тратите на ИИ и на что? Признавайтесь в комментах — товарищу майору не скажем.
@analyst_exe
