🤔 Доверяй, но проверяй
Развиваемая нашей командой система использует ML-модели для классификации клиентских запросов. Всё работает хорошо, никаких if’ов и поисков подстрок. В общем, стильно, модно, молодёжно.
Каждая модель проходит обязательную проверку на качество и только после этого передаётся нам для использования. И, вроде бы, всё хорошо, но на этапе тестирования функциональности, использующей последнюю модель, возникли вопросы. Почему-то для некоторых типовых вопросов модель определяла неверный класс. Почему так, ведь метрики модели априори отвечали ожиданиям?
Оказалось, что на качестве сказывалась одна из используемых в коде библиотек. У разработчика модели стояла более свежая её версия, и с ней качество работы модели действительно было на высоте. В нашем проекте использование более ранней версии приводило к падению качества. Только после обновления результаты сравнялись.
Мораль: окружение имеет значение. Внедрение в проект стороннего модуля, даже отлаженного и в высокой степени автономного, может не дать ожидаемого результата. А раз так, то имеет смысл на своей стороне покрывать такие модули дополнительными тестами, это даст возможность вовремя увидеть возможные аномалии.
#ai #qa #любопытное
Post #151
368
- 🤯 4
- 🔥 1