TGViewer
Channel Public Channel
Pavel Zloi

Pavel Zloi

@evilfreelancer

Эксперт по Cursor AI №1 в России:
https://stepik.org/course/294150/promo

Контакт:
@eprogrammist

Сооснователь:
https://neuraldeep.ru/

20 лет в IT

https://github.com/EvilFreelancer
https://boosty.to/evilfreelancer
https://pay.cloudtips.ru/p/937f48ac
Subscribers
4.52K
Photos
764
Videos
85
Links
1.1K

Showing posts older than #1850 · Back to latest

Older Posts 17 shown
Post #1849 5.65K
Cursor - это выпрямитель рук

По ощущениям это словно дарк соулс от мира кодовых агентов. Ошибок не прощает. Надо очень внимательно следить и за тем, что ты попросил агента сделать, и за тем, как он это в итоге сделал. Один раз пролистал диф по диагонали, и в репозитории уже живёт что-то, что вроде работает, но совсем не так, как ты задумывал.

Зато дисциплина от этого подтягивается (хотя многих это и отпугивает). Начинаешь формулировать задачу точнее и читать сгенерированный код внимательнее, апрувить не сразу пачкой, как в Codex и Claude Code, мол я сделял, а небольшими кусочками, с учётом контекста.

Поэтому выскажу мнение основанное на личном опыте:
Если научиться работать с Cursor, то и с любым другим агентом дальше пойдёт легче и проще.


Как раз про это я собрал бесплатный курс про Cursor AI на Stepik, там всё по шагам, от первой настройки до работы с большими проектами.

PS. Кому удобнее читать офлайн, весь курс собрал в PDF-книгу
  • 😁 22
  • 👍 20
  • 🤡 5
  • 👎 4
  • ❤ 3
  • 🤣 2
Post #1848 2.72K
Разговорился тут со знакомыми насчёт разработки через агентов, был удивлён что мои визави не знают про git worktree, да что ворктри даже про git stash тоже и мне стало любопытно много ли у меня подписчиков кто не знает что такое git worktree и как им пользоваться.

Пользуетесь ли вы этой фичей при работе с агентами, если да, то подскажите какие у вас кейсы, ну и если нет то тоже расскажите, почему так получилось?
  • 😱 13
  • ❤ 1
Post #1847 2.53K

Forwarded from Junior AI PM

#мнение
Сейчас Codex лучше Claude Code

Здравствуй, неподгоревший читатель. Этот пост про то что сейчас рабочая лошадка из фронтир моделей. Также ответ на Пашино https://t.me/evilfreelancer/1846

Если нужен один дефолт -> GPT-5.6 Terra в Codex Pro с medium usege без Fast mode. Мое глубокое субъективное имхо на 3 августа 2026. По кредитной шкале при одинаковом токенном профиле Sol : Terra : Luna = 25 : 10 : 1: Terra жжет в 2,5 раза меньше Sol. При этом на SWE-Bench Pro (если он для вас аргумент) у нее 63,4% против 64,6% -> отдали 1,2 п.п. качества, получили 2,5x емкости лимита

Ближайший аналог у Claude -> Sonnet 5, но его стоит доставать под мутный скоуп и широкий рефакторинг. А также по личным расчетам через
ccusage стоимость задачи $0.50–1.5+ (с ретраями) и порядка 2% лимита на тарифе в $100 против $1–3 у Sonnet 5

Арифметика дальше проверок была на отдельном аккаунте с $20 подписками:

- На Plus фикс в 400 строк через Sol Medium на 5000 строковом проекте на расте съел 15% пятичасового лимита;
- Luna Extra High за 25 минут написала 2500 строк с тестами за 5% недели, следующие этапы жрали по 2–6%, а ревью Sol и исправление найденного добра -> еще 4% + 5%
- Сопоставимый блок на Opus 5 High съел 35% пятичасового и 4–5% недельного лимита.

В интернете примерно тоже самое говорят. Там таже Terra Medium уничтожила всю неделю Plus за шесть часов, пока пользователь Pro гонял Sol Extra High по 6–8 часов в день больше недели без упора в кап. Главный множитель -> тариф, контекст и число переделок. Luna дешевая, пока после нее не приходится звать взрослую модель с веником и как тут жалуются

Еще сильнее модели влияет агентная оболочка. Некий Composio прогнал один Kimi K3 через три оболочки на 28 одинаковых задачах: успехи почти равны — 22/28 у Kimi Code, 21/28 у Hermes, 20/28 у Claude Code; медиана расхода -> 61k, 67k и 340k токенов, время -> 297, 179 и 348 секунд. Claude Code сжег в 5,6 раза больше токенов ради почти того же результата. В следующем тесте Codex против Claude Code на 26 задачах Claude взял 19/26, Codex 17/26, но тратил 347 против 236 секунд -> примерно 7,6 против 10 успешных задач в час. Claude точнее на 7,7 п.п., Codex производительнее на 32%. Серия твитов отсюда

При этом Claude Max способен быть безумно выгодным: один жосткий пользователь прогнал через Claude Code 21,5 млрд токенов, заплатив около $1000 за подписки https://x.com/wecko_ai/status/2083783073800585326. Но миллиарды токенов не равны миллиардам пользы: длинная история, повторные чтения, кеш и сабагенты прекрасно превращают Max в тыкву за одну жирную сессию

И лайфхак: обычный чат с Sol Extra High и Codex расходуют разные пулы, поэтому подключаем GitHub, включая разрешенный приватный репозиторий, делаем ресерч, архитектуру и прототип в чате, а готовый план отправляем Terra в Codex.

P.S. Sol Extra High под пиво -> Terra в шахту, Fable 5/gpt 5.6 Sol бесполезные релизы
  • ❤ 13
  • 😁 6
  • 🤔 4
  • 💩 2
Post #1846 3.05K
Codex хуже ClaudeCode и даже Cursor

Не смотря на то, что модели GPT показывают лучшие результаты своей работы, сам кодовый агент не имеет одной фундаментальной фичи, без которой организовать нормальный коллективный флоу разработки крайне сложная задача.

Я говорю о Rules конечно же.

Если кратко, то рулесы по логике своей работы очень похожи на скилы, с той лишь разницей что добавляются в контекст агента, когда тот затрагивает тот или иной файл или ту или иную директорию, так вот обычно в рулесах я описываю флоу работы над проектом, что делать и как, где какие фичи лежат, описываю как деплоить и так далее. Однако, авторы codex и трёх desktop его вариаций решили что рулесы не нужны и что AGENTS.md хватит всем.

Как побочный эффект код сгенеренный через codex ломает старые фичи сделанные через claudecode и cursor в вашем проекте о существовании которых вы вероятно уже забыли, так как их наличие для вас само собой разумеющееся и тесты тут не помогают, кодекс просто ленится править код, а вместо этого правит тесты.

Так что, увы и ах, пока нормальных рулесов не появится ходить кодексу в ревьюирах клода и баста.
  • 🤡 43
  • 💩 12
  • ❤ 9
  • 👎 8
  • 👍 6
  • 🤷‍♂ 5
  • 😁 2
  • 🔥 1
Post #1843 11.8K
Сбросы лимитов - выкатили в NeuralDeep

Упёрся агент в лимит, и всё, дальше сидишь и ждёшь, пока обнулится окно расхода. Теперь ждать не обязательно. В кабинете появился запас ресетов, один такой сброс мгновенно обнуляет израсходованную трёхчасовую сессию и неделю, и можно сразу работать дальше.

Запас пополняется раз в месяц, по два ресета на платных тарифах, на free-тарифе их пока нет. Копить не выйдет, система дотягивает баланс до двух, а не добавляет сверху. Больше двух бывает в одном случае, когда ресеты подарили вам друзья, такие сверх нормы не сгорают.

Ещё ресет можно подарить другу, зарегистрированному на NeuralDeep. Вводишь его email, ему уходит письмо со ссылкой, ссылка живёт сутки. Списывается подарок сразу, но если друг не принял вовремя или ты передумал и отозвал, сброс вернётся на баланс.

Посмотреть можно в личном кабинете: https://hub.neuraldeep.ru/app/resets
  • 👍 8
  • 🔥 3
  • ❤ 2
Post #1842 1.72K

Forwarded from Поляков считает: AI, код и кейсы

Туту проводит хакатон: хороший способ познакомиться с командой

Помните я рассказывал, что запустили MCP для сервиса путешествий Туту. Самый популярный запрос в личку по итогам анонса был про то, как я нашел проект и договорился с командой. Ответ простой, команду я уже знал, прототип приготовил за вечер. Сделал демо, оно зашло.

Вчера Туту анонсировали хакатон с призами: https://hackathon2026.tutu.ru

Призы символические — деньги на покупку внутри сервиса. Но принципиально это предложение почелленджить интересные идеи для тревел-сервиса на живом API компании.

🙋🏻‍♂️ Сижу в жюри, буду оценивать решения

Ваш покорный слуга приглашён в качестве судьи. На прошлой неделе проходило аналогичное мероприятие со студентами центрального университета. Лично мне зашло два решения. Одни ребята сделали ассистента, который управлял фильтрами на сайте (как Elevenlabs у себя), другие сделали Тиндер предлоджений.

🚀 Если бы я участвовал в таком челлендже, я бы наверное сделал тиндер-механику в целом для тревела. Типа поле ввода: путешествие на двоих с семьёй и варианты, которые обучаются в зависимости от сделанных человеком лайков. Тут отлично вписываются и агенты и рексис и спецпроекты для маркетинга.


🤔 Кому бы я советовал принять участие

Если интересуетесь карьерой в тревелтехе, ИИ-агентами, в т.ч. как владелец продукта — хакатон однозначно для вас.

Кроме призов организаторы совершенно точно заинтересованы в формировании кадрового резерва + с удовольствием реализуют вместе интересные проекты.

Если собираетесь участвовать — напишите в комментариях, в какую сторону копаете: подбор поездки, интерфейсное решение или свой агент поверх MCP.

----

Поляков считает — AI, код и кейсы
  • ❤ 7
  • 🤮 1
Post #1841 2.15K
Post #1840 2.27K
На канале @nlp_daily прочёл про бенчмарк SlopCodeBench (arxiv:2603.24755) в свеженьком посте.

Данный бенчмарк симулирует работу пользователя над некоей кодовой базой и тестирует слопность (переусложнённость и раздутость) кода который генерят модельки через свои кодовые агенты.

Циферки оригинальной работы есть на сайте лидерборда бенча, а вот тут можно про более свежие модели почитать, из всех имеющихся материалов я собрал для вас сводную инфографику одной картинкой.

Лучший результат у GPT 5.5, это 14% в строгом зачёте и 28% в изолированном, и ни одна модель не довела до конца ни одной задачи из двадцати. Свежие муравьиные модельки проблему не сильно исправили, на 17 чекпоинтах Opus 5 решает заметно больше соседей, 24% против 6%, но платит за это тройным объёмом кода, 29 тысяч строк против 9, и впятеро большим числом функций, при этом 93% строк всё равно триггерят слоп-правила.

Любопытный разрез по вендорам виден на левой нижней диаграмме. GPT и Codex занимают верхушку и в среднем меньше слопят код (эрозируют), а Opus и Sonnet решают прилично, но переусложняют код сильнее всех, вероятно в этом нюансе и сокрыта причина почти что религиозного противостояния между адептус клодкодус и хранителями кодекса.

Вполне ожидаемый вывод в том, что если дать агенту кодовую базу, над которой тот будет итеративно работать, решая проблему не сразу, а маленькими шажками, и вносить правки самостоятельно, ваша кодовая база, сюрприз, сюрприз, превратится в разбухшую кашу из лапшы и повторов, я конечно не кулинар, но аналогию думаю вы поняли.

Так что разговоры про агента, который сам хозяйничает в вашем репозитории длительное время без присмотра человека, это пока что сказки в пользу бедных.
  • 🔥 17
  • 👍 3
  • ❤ 1
Post #1839 1.85K
Перенос TOTP из Яндекс.Ключа в KeePassXC

Внезапно не про ИИ заметка. В общем есть одна консольная программка, которая просит вводить TOTP коды, есть Яндекс.Ключ (режим TOTP) на айфоне на котором настроен генератор одноразовых паролей, есть KeePassXC у которого наличествует специальный механизм генерации TOTP.

Проблема такая: чтобы воспользоваться той программкой консольной нужно находить телефон, запускать Яндекс.Ключ, читать одноразовый пароль, вводить его в консольку, жать интер. Почти каждый день приходится это делать, в общем мне это надоело и решил немного автоматизировать данный вопрос.


Или я сломаю твой секреееет

Для начала потребовалось заполучить секретный ключик base32 из генератора Яндекс.Ключ, сделать это было проще чем я думал, в меню настроек ⚙️ есть строка "Сохранить в файл" после нажатия на которую вылезает формочка с выбором куда сохранить, на Android проще всего сохранить на карту памяти, а на IOS пришлось выбрать iCloud.

Система создаст текстовый файл key_backup (из которого при желании можно восстановиться) вот такого примерно вида:
[
{
"name": "system 1",
"secret": "xxx",
"techInfo": "otpauth://totp/url"
},
{
"name": "system 2",
"secret": "xxx",
"techInfo": "otpauth://totp/url"
}
]

Этот файл через просмотрщик открываем, ищем json-объект нужной системы, в нём находим поле secret, оно нам пригодится на следующем шаге.


Да просто захотел тебе сказать, свой пароль от почты, барабака35, пиши, забудешь точно

Теперь заходим в KeePassXC, находим нужную учётку для которой я генерил этот одноразовый пароль через Яндекс.Ключ, на ней правой кнопкой мышки жму и выбираю в менюшке "TOTP" там выбираем "Настроить TOTP...", откроется модалка.

Сверху в инпуте "Секретный ключ:" пишем то, что мы нашли в key_backup, остальное по дефолту, нажимаем "Ок" внизу, модалка закроется.

Теперь мы можем либо комбинацией клавиш "Ctrl + T" скопировать код в буфер, либо через менюшку "TOTP" > "Скопировать TOTP".


Не хочешь - не верь мне

Настроить это полдела, давайте проверим что всё ок работает, открываем Яндекс.Ключ и KeePassXC (Ctrl + Shift + T), смотрим, сравниваем, если циферки одинаковые, то всё настроено правильно и можно дальше думать про интеграцию.

Если кратко, то есть консольный тул keepassxc-cli, через неё можно открыть базу данных и запросить TOTP нужной записи, делаем это так:
keepassxc-cli show -t ./password.kdbx "Группа/Учётка"

Если на базе есть пароль то отобразится приглашение его ввести, ну а дальше вашу фантазию уже ничего останавливает.

Кстати, в интерфейсе можно посмотреть правильный путь, главное после того как скопируете его убрать пробелы перед и после "/", ещё нужно убрать "Корень/" вначале, плюс если в имени записи или группы есть пробелы надо будет добавить защиту например: "Группа/Вложенная\ группа/Учётка\ с\ пробелом"

Надеюсь эта маленькая заметка вам будет так же полезна как и мне.
  • 👍 12
  • ❤ 3
Post #1838 2.22K
Эх, а мне так хотелось заглянуть на сходку авторов гигачата, но я к сожалению слишком поздно опомнился и немного запоздал с подачей заявки.

PS. Надо бы бота себе настроить, чтобы календарик мероприятий собирал.
  • 😢 7
Post #1837 2.78K
/screenshotting-gui скил создания скриншотов GUI-приложений

Началось всё с курса по Cursor, который я собрал для Степика, там на каждый второй шаг нужна картинка интерфейса в строго определённом состоянии, скажем открытое меню, окно настроек или панель агента с готовым диффом. Снимать такое руками муторно, а самое неприятное начинается, когда выходит новая версия Cursor и надо переснимать окошки заново.

Ну я и попросил агента накидать пару скриптов, чтобы он делал это сам, и результат мне настолько понравился, что я решил упаковать эту историю в формате скила screenshotting-gui.

Чтобы получить картинку поднимается виртуальный экран через Xvfb, это X-сервер, который рисует в память. На этом экране из-под моей же учётки стартует нужное приложение, дальше агент водит по нему синтетическим вводом через XTEST (клики, клавиши, скролл, драг), снимает кадр через ImageMagick и им же его размечает, то есть рисует рамку со скруглением вокруг нужной кнопки, обрезает лишнее, ставит стрелку или склеивает два кадра в один.

Удобство в том, что всё это живёт в headless-режиме на отдельном дисплее :99. Приложение не всплывает поверх моих окон, не ворует фокус и не дёргает курсор, я спокойно работаю дальше, пока где-то в фоне агент тыкает по кнопкам Cursor, не сравнить с тем как работает Playwright MCP постоянно отбирающий у меня мышку.

На клодкод ставится как плагин из моего каталога rpa-skills парой команд:
/plugin marketplace add EvilFreelancer/rpa-skills
/plugin install screenshotting-gui@rpa-skills


Пользоваться можно и руками, весь цикл выглядит примерно вот так:
export XCTL_DISPLAY=:99
Xvfb :99 -screen 0 1920x1080x24 -ac & sleep 1

DISPLAY=:99 cursor & sleep 3
python3 scripts/xctl.py winlist

python3 scripts/xctl.py click 1490 1003
python3 scripts/xctl.py shot raw.png --crop 1270 560 650 520
python3 scripts/annotate.py box raw.png final.png 1300 600 1720 680

Но по-хорошему всё это агент делает сам, ему достаточно сказать "перечитай скил и пересними скриншот окна настроек с подсветкой поля модели".

Реп: https://github.com/EvilFreelancer/screenshotting-gui
Каталог скилов: https://github.com/EvilFreelancer/rpa-skills
  • 🔥 15
  • 👍 5
  • ❤ 4
  • 🤣 1
  • 🫡 1
  • 🆒 1
Post #1836 2.56K
Пока суть до дела обновил свой сайтик портфолио, давно хотел сделать чтобы на главное был изображён граф технологий связанных друг с другом.
rpa.icu Павел Рыков - AI/ML-инженер Агентные системы, локальный инференс LLM, дообучение и квантизация моделей.
  • ❤ 16
  • 👍 8
  • 🔥 8
Post #1834 2.97K
Про сертификат курса про Cursor AI

Как наверняка многие помнят ранее я выпустил самый полный и самый лучший в России курс про работу с Cursor AI и поступил ряд просьб о том, что было бы неплохо добавить возможность получить сертификат, для этого самый простой путь это сделать курс платным, чего я категорически не хотел бы.

Однако, есть способ сохранить курс бесплатным и добавить возможность получить сертификат об успешном прохождении, для этого требуется чтобы обучение прошло 500+ человек, на данный момент число учащихся уже почти 400 человек.

Поэтому всем кому хочется получить сертификат и при этом сохранить курс в бесплатном статусе моя маленькая просьба: пожалуйста, порекомендуйте мой курс ещё 100 своим друзьям и я смогу отправить заявку команде Stepik.
  • 🔥 41
  • 😁 2
  • 🤡 1
Post #1831 2.42K
Пост про то "Как делать скилы правильно и собрать из них маркетплейс" на Хабр.

В какой-то момент мне надоело копировать в каждый новый чат с агентом один и тот же блок инструкций из cursor-vibe-prompts, чтобы заставить агента работать так, как мне нужно.

Поэтому решил упаковать эти промты в скилы, разложить по репозиториям и собрать собственный маркетплейс rpa-skills, который легко подключить к Codex, Claude Code или Cursor одной командой.

По мотивам этой эпопеи решил запилить пост на Хабр, там рассказываю, как я дошёл до жизни такой, про лучшие практики сборки агентных скилов, как их валидировать сабагентами и как собрать свой маркетплейс за вечер и много чего ещё.

Желаю приятного прочтения!
  • 👍 20
  • ❤ 5
  • 🔥 3
  • 👎 1
Post #1830 2.12K
С удовольствием прочёл сегодня публикацию "Дообучил pretrain ruGPT3 XL 1.3B до уровня LLM (~2020 год, ChatGPT выйдет через 2 года). Сравнение с Gemma3 1B 2025 года" на Хабр от того же автора который про модель habrGPT 0.5B писал.

Там он использовал ruGPT3XL которую я конвертил из весов MegatronML, приятно видеть, что плоды моих трудов востребованы.

PS. По традиции приглашаю всех поставить лайк на Хабре под этой публикацией, такой контент нам нужен.
  • 👍 17
  • ❤ 3
  • 😁 1
Post #1829 2.63K
Выступал намедни на площадке Podlodka с докладом на тему "On-premise модели для разработки в закрытом контуре".

На нём прошелся тяжелой поступью по мечтам людей об обучении моделей на своей кодовой базе, потом рассказал про то как правильно настроить харнес для коддинга заточенный под on-premise кодовые модельки, а под конец часть была про то сколько стоит поднять локальную модель в сравнении с облаками и какое для этого желательно иметь железо.

Будут рад ответить на ваши вопросы, приятного просмотра.

YouTube | Boosty
  • 🔥 27
  • 👍 3
Post #1828 2.2K
Pavel Zloi Ну что, давайте наверно вечерком стримчанский запущу? Есть желание провести очередное кодревью свежих пулреквсетов в проекте Coddy Agent вместе с Антоном @foxyminds. Стрим будет на Твиче, формат плюс минус планирую такой же как в прошлый раз, разве что качество…
Поехали 🚀

https://www.twitch.tv/evilfreelancer
Twitch EvilFreelancer - Twitch Канал простого программиста, рассказываю про ИТ, Linux, AI, ChatGPT, Docker и тд. — EvilFreelancer streams live on Twitch! Check out their videos, sign up to chat, and join their community.
  • 🤮 2
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →