после всех тестов и сравнений у меня в итоге осталась вот такая рабочая схема:
ChatGPT в браузере и Codex + кастомные скиллы, инструменты, тесты
я пробовал gsd, gstack и много других штук, но в итоге понял, что для меня лучше нынешней связки просто нет
даже самые навороченные воркфлоу не дают мне такой результат, как deep research в ChatGPT + реализация через Codex вкупе с кастомными инструкциями и так далее
1 шаг
через микрофон наговариваю все свои мысли и собираю из этого промпт для ChatGPT Extended Pro
2 шаг
потом закидываю архив проекта + промпт в ChatGPT Extended Pro. В промпте всегда прошу составить roadmap, сделать очень глубокий анализ, а после - столько промптов для Codex, сколько реально нужно, чтобы все закрыть
3 шаг
дальше закидываю по одному промпту в Codex, каждый раз в новый чат
4 шаг
после всех проходов снова собираю архив и кидаю его в тот же чат на проверку
во всей этой штуке я использую только кастомные скиллы и свою собственную архитектуру
в каждом проекте у меня больше 100–2000 тестов, плюс guardrails на архитектуру, соблюдение правил импортов и так далее
почти в каждом проекте есть кастомный скилл/скиллы на code-style, архитектуру, лучшие практики и тд. Плюс ссылки на нужные документации. На каждый проход агент это все читает и жестко впитывает
каждое ui/ux изменение включает в себя прогон реального браузера и скриншоты. Делаю это через agent-browser от Vercel, очень удобная штучка со всеми инструментами внутри
под проекты на macOS я использую build macOS плагин (внутри codex) + computer use в Codex. В плагине уже 11 отличных скиллов. Под проекты на iOS - такой же плагин, но там еще и mcp внутри, а это вообще мясо
по тестам у меня обычно Playwright, Vitest, Cypress и подобные штуки, но это не под каждый проект подойдет. Поэтому под каждый проект - свой набор инструментов. А общий подход к тестам я уже расписывал в этом постике
в итоге получается так
chatgpt extended pro 5.5 жестко планирует, глубоко ресерчит, ищет в интернете и обогащает ответы и промпты
gpt 5.5 high / xhigh 5.5 делает все по плану, используя архитектуру, скиллы и указания из промпта, а потом проводит полные тесты или часть тестов
если нужна дополнительная верификация/посчитать количество запросов, то я подключаю:
nextjs mcp
chrome-dev-tools
tanstack react dev tools (только для tanstack-react-query)
в итоге агент у меня всегда жестко ограничен
архитектурой и code-style
планом работ
технологиями
и проверками результата через все возможные тесты
поэтому он почти всегда выдает мне идеальный результат на любую хотелочку!
