У нас уже и были, и остаются огромные проблемы с объёмом легаси-кода, который существовал, когда его писали люди. Почему мы думаем, что ускорение этого процесса будет улучшением?? )))
Откуда мы знаем, что терабайты вайб-кода вообще работают?
Наиболее распространённый ответ: я просмотрел код, прогнал тесты, и все в порядке.
Именно здесь дальнейшее обсуждение становится затруднительным, потому что трудно ответить на это утверждение конструктивно, не рискуя обидеть людей :)
Более того, сколько бы ни было ошибок в проде, и сколь бы сильно не росло их количество при вайб-кодинге, как только вы фиксите очередной баг, тимлид продолжает верить, что код-ревью может предотвратить баги в будущем, хотя их частота лишь растёт.
(В целом странно конечно, что умение хорошо просматривать код теперь гораздо более ценно, чем умение хорошо писать код.)
TDD? Да, это мощная штука, близкая к формальным спецификациям, если ей следовать вдумчиво, но как вы проверите, что агент действительно этому следует? На уровне агентов это чистый карго-культ. Агент заявит, что якобы тестирует систему, и даже следует базе "красный-зелёный-рефакторинг", но откуда вы знаете, что это не симуляция? Что это, весьма вероятно, программа, которая только выглядит так, как будто она проходит все тесты, но на самом деле не имеет отношения к реальным требованиям?
Вместо того, чтобы самому/агентами писать код в прод, и затем просить нейронку покрыть это всё тестами, почему бы не написать сперва тесты, и только потом не попросить агентов реализовать их?
Ну, по какой-то причине, которую я никогда не понимал, 98% разработчиков не нравится писать тесты, так что это, вероятно, тоже нереально.
Если вы не участвуете в создании тестов, вы не можете сказать, какие гарантии они дают (и дают ли хоть какие-то гарантии вообще). И тогда тестирование становится простой церемонией, призванной подарить вам приятное тёплое чувство без реальной защиты.
Ну ладно мэйнстриновские проекты, фиг с ними, с интересами пользователей в них никогда не считались, и десятилетиями сбрасывали на юзеров все проблемы с выявлением багов в духе "раннего доступа".
Но что насчёт КИИ? Или даже немного более широкая тема: софт, где качество -- реально ключевой критерий, и поэтому так важны подходы по проверке и обеспечению корректности кода. Мы сегодня видим экспоненциальный рост объёма софта, создаваемого нейронками, в то время как объёмы (около)критического кода остаются пропорционально сопоставимыми ручным объёмам. Ну, потому что эту цифру трудно масштабировать.
К сожалению, я также ожидаю, что всё больше подобных систем будут оказываться ненадёжными вследствие бесконтрольного распространения вайб-кодинга, и будут потеряны (и уже теряются) и огромные финансы, и жизни. И более того, выводов из этого, как и до сего дня, никто не сделает (что будет легко измеряемо по росту критических сбоев КИИ по самым разным причинам).
Post #2282
831
- 👍 35
- ❤ 9
- ✍ 8