На VC вышел мой разбор о том, почему 10/10 запусков AI ещё не доказывают готовность результата.
Один показатель может смешать оборванный ответ, исправленный формат, содержательную ошибку и человеческий отказ. Поэтому в оценке сначала нужно отделить завершённость артефакта от качества и приёмки.
Статья: https://vc.ru/ai/3119776-pochemu-uspehnye-zapuskai-ai-ne-garantiruyut-gotovnost-k-rabotye
Post #43
21