TGViewer
DoQA DoQA @doqatms · 800 subscribers
Post #721 194
У языковой модели нет "ожидаемого результата"🤖

Один и тот же запрос два раза подряд — два разных ответа. Оба могут быть корректными. Или оба — нет.

Вся тестовая документация построена вокруг фразы "ожидаемый результат". На ИИ-фичах это ломается сразу: сравнением строк такое не проверить.

Разобрали, что конкретно меняется в работе QA:

• как переписать тест-кейс на проверяемые свойства ответа вместо точного текста
• зачем нужен golden set и с чего его начинать (подсказка: не с успехов)
• почему судья-модель тоже требует тестирования — и как её откалибровать
• что добавить в баг-репорт, если дефект не воспроизводится по шагам
• как ловить регресс, который приходит не от вас, а от обновления модели у провайдера

Плюс чек-лист что сделать до начала тестирования. Что в тестовой документации, а что в прогонах и критериях релиза.

Читать 👉 на сайте
  • ⚡ 4
  • 🆒 1
More from @doqatms
  1. Oct 1, 2026Apple выкатила iOS 27 📱, и часть пользователей нажимает «Обновить до iOS 27», а в ответ п…
  2. Sep 30, 2026Тест зелёный. Требование, которое он проверяет, поменяли две недели назад. Формально покры…
  3. Sep 29, 2026Метрики QA собраны, дашборд зелёный🟢, а на вопрос «почему продукт стало дороже менять» от…
  4. Sep 28, 2026Коробка догнала облако: DoQA On-Premise 4.3 (Titanium) уже доступна 🎉 Это версия про авто…
  5. Sep 25, 2026Ревью тест-кейсов в большинстве команд не проводится.🥲 Человек, который единственный точн…
  6. Sep 21, 2026DoQA 4.3 (Titanium) — самый крупный релиз для автоматизированного тестирования Что внутри:…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →