В марте я писал, что у меня на Mac Mini живет OpenClaw, который тратит 100 рублей в неделю. Логика была в покупке очень дешевых Plus подписок через https://lzt.market/llm/?order_by=price_to_up и подключение Codex подписок в CLIProxyAPI который прикрыт Cloudflare Warp.
С начала апреля к моей коллекции агентов добавился Hermes (и я точно могу сказать, что он не всегда круче глючного OpenClaw) потребление токенов увеличивалось.
🩼 Конечно это не могло нравится OpenAI
Такая схема у нас во внутренних кругах называется «абьюз подписок» — получение сервиса через нарушение условий его использования.
Anthropic за такое ранее банил аккаунты, OpenAI подключили смс-верификацию. Для получения смс и одноразовых номеров телефона я использовал https://smsfast.cc, в совокупности в конце мая уходило порядка 300-400 рублей на один аккаунт с подпиской Plus + подтверждение.
🤔 Короче я понял, что у меня уходит неприятно много времени на такой абьюз-менеджмент и стал морально готовиться к тому, чтобы платитить за API. Осталось найти кому.
🐳 DeepSeek продлил дисконт навсегда
Когда делал барбершоп тесты, я отметил DeepSeek v4 Pro как реальный конкурент SOTA моделей за супер-низкую цену. Тогда было майское промо — 1 доллар за миллион токенов. 22 мая DeepSeek написал твит, что промо продлевается навсегда. Вот тогда я решил, что можно смело мигрировать своих агентов с OpenAI GPT 5.4 на Deepseek.
Короче уже 5 дней я работаю через Дипсик и траты в сутки составляют в среднем полтора доллара. Месяц использования будет стоить около 50 долларов: дороже одной подписки плюс, но по лимитам на одной такой подписке было бы тесно.
⚠️ Я не использую OpenClaw и Hermes для кодинга и какого либо ассистирования в работе — только рутина: тулы для бронирования парковок, запись на стрижку и т д
🔬 Пара проверок
Основной работой агентов в моем случае является вызов различных тулов: заказ пропусков, парковок для гостей, стрижки, поэтому я решил проверить не только DeepSeek, но и локальные модели на бенчмарке PAC1 — чтобы сравнить, насколько они будут хорошо справляться с вызовом инструментов.
Тут есть еще и профессиональный интерес, так как я активно тестирую MCP для бронирования путешествий, там есть бенчмарк с эвалами и один из прогонов я делаю локальными моделями — чтобы понимать, как они держат большой контекст с кучей инструкций.
Короче сравнил на этом бенчмарке Опус без ризонинга и другие модели. Вывод — Дипсик близок к SOTA, надо брать.
Из интересного — результаты квантованного Qwen 3.6, я был очень удивлен, когда увидел, что он обходит полносвязную Gemma 4 — кажется отличный кандидат для туристического бенчмарка.
Короче говоря ставка на дорогих агентов, кажется будет скомпенсированна Китаем. Хочется верить, что осенью Сбер всё-таки выпустит обновление и сделает цены на свои модели преемлемыми.
Если у вас был опыт запуска агентов на локальных или недорогих моделях — буду рад отзывам в комментариях.
----
Поляков считает — AI, код и кейсы

