Скетчбук: Мысли, черновики, задумки, релизы и не только.
“Здесь не боятся черновиков. Здесь код и жизнь - в одном блокноте.”
Автора можно найти:
https://github.com/dsdred
https://infostart.ru/profile/295466/
https://vk.com/dsdred
Telegram -> @dsdred
Post #452
101

#История
Добрый день, друзья!
Хочу рассказать одну историю, которая произошла на прошлой неделе.
Я уже много раз писал про проект GoAl, который разрабатываю. Решил дать его на ревью и в ответ получил пару мест, которые желательно посмотреть.
Напомню, как разрабатывается GoAl.
У меня есть сильная модель, которая командует локальной. Локальная делает работу и выдаёт отчёты, по которым потом сильная говорит: всё хорошо или надо ещё что-то сделать.
А тут вышло так, что есть косяки — значит, отчёты устроили, а результат не агонь.
Тогда я решил провести полный ревью, но хотелось уложиться в определённую сумму денег.
Примерно в 0 рублей.
Взял ИИ-шки, у которых есть веб-чаты: ChatGPT, Grok и Claude.
У каждой модели спросил:
«Если я скину zip с проектом, сможешь провести ревью?»
Все ответили положительно. Я запросил промпт на массовое ревью, подготовил zip проекта, скормил и стал ждать.
ChatGPT и Grok отработали отлично. А вот Claude начал говорить, что файлов много, он не будет сильно вникать и пройдётся по верхам…
Такой ответ мне был не очень интересен, поэтому я запустил Kiro и на бесплатном тарифе выбрал Claude Sonnet.
Так я получил три независимых ревью.
Дальше взял эти три ревью и отдал их в ChatGPT, чтобы получить одно общее.
Затем все ревью отправил в Claude Sonnet на опровержение — и получил результат: что действительно не так, а что галлюцинации.
После этого всё отдал основной модели. Выяснилось четыре критических места, а один тест из семи работал только для того, чтобы выдать зелёный цвет.
Решил, что такие ревью надо брать на регулярную основу перед выпуском релиза.
А как вы проводите ревью кода генерации?
Добрый день, друзья!
Хочу рассказать одну историю, которая произошла на прошлой неделе.
Я уже много раз писал про проект GoAl, который разрабатываю. Решил дать его на ревью и в ответ получил пару мест, которые желательно посмотреть.
Напомню, как разрабатывается GoAl.
У меня есть сильная модель, которая командует локальной. Локальная делает работу и выдаёт отчёты, по которым потом сильная говорит: всё хорошо или надо ещё что-то сделать.
А тут вышло так, что есть косяки — значит, отчёты устроили, а результат не агонь.
Тогда я решил провести полный ревью, но хотелось уложиться в определённую сумму денег.
Примерно в 0 рублей.
Взял ИИ-шки, у которых есть веб-чаты: ChatGPT, Grok и Claude.
У каждой модели спросил:
«Если я скину zip с проектом, сможешь провести ревью?»
Все ответили положительно. Я запросил промпт на массовое ревью, подготовил zip проекта, скормил и стал ждать.
ChatGPT и Grok отработали отлично. А вот Claude начал говорить, что файлов много, он не будет сильно вникать и пройдётся по верхам…
Такой ответ мне был не очень интересен, поэтому я запустил Kiro и на бесплатном тарифе выбрал Claude Sonnet.
Так я получил три независимых ревью.
Дальше взял эти три ревью и отдал их в ChatGPT, чтобы получить одно общее.
Затем все ревью отправил в Claude Sonnet на опровержение — и получил результат: что действительно не так, а что галлюцинации.
После этого всё отдал основной модели. Выяснилось четыре критических места, а один тест из семи работал только для того, чтобы выдать зелёный цвет.
Решил, что такие ревью надо брать на регулярную основу перед выпуском релиза.
А как вы проводите ревью кода генерации?
- 🔥 2

















