Натравил его на свой репозиторий с игрой Endless Clickomania (в которую можно поиграть вот тут):
1) Codex быстро нашёл опечатку в README, сабмитнул PR, который я принял.
2) Нашёл баг, который заключался в том, что в паре мест бесполезно вызывалась функция, которая проверяет и обновляет Best score. Ни на что это не влияло, никак игроку не было заметно, но формально лишний код, который зачем-то написали ChatGPT или Gemini. ОК, принято.
3) Нашёл и исправил некрасивый вывод текста. Было "Last blocks: 0 | Best blocks: 0 | Total blocks: 0", а стало "Last: 0 | Best: 0 | Total: 0". Тоже принято.
4) Предложил новую фичу — чёрную клетку-бомбу, которая уничтожает все клетки по вертикали и горизонтали от себя. Предложенный код выглядел очень понятным и лаконичным, но не был принят, так как дизайн фичи не учитывал теоретическую бесконечность игры: Codex предложил генерировать клетки-бомбы один раз при старте игры, а для бесконечной игры конечно же их надо рандомно генерировать по ходу.
📍 Что я заметил по ходу буквально 15-минутной сессии использования:
- делать 3 задачи параллельно это прикольно: прокликал стартовать разработку -- и дальше переключаешься между ними, чтобы проверить статус, посмотреть diff, и разрешить ему сделать PR;
- можно подключить сразу несколько репозиториев и параллельно давать задачи на разработку;
- кажется, пока очень большой оверхэд на запуск нескольких задач в одном и том же репозитории -- по сути, в мелькавших строчках видно, что оно его каждый раз заново анализирует и как-то готовит к работе;
- это "программист", который написанное внимательно читает и начинает делать -- было бы неплохо, если бы он задавал вопросы перед тем как делать или как-то ещё рассказывал про то, что он понял и собирается сделать; (впрочем, этого можно добиться задавая вопросы самостоятельно)
💡В целом я уже почти вижу как я толпой таких агентов командую, чтобы