В этой статье Вадим Ломшаков, руководитель AI направления, отвечающий за улучшение и контроль качества Explyt Test, делится результатами нашего внутреннего исследования — сравнения языковых моделей от GPT-4.1 до китайских DeepSeek и Qwen.
Мы оценивали различные аспекты генерации тестов с помощью Explyt Test: качество сценариев, качество тестов и соответствие их сценариям.
🙃 Из интересного: последний DeepSeek не хуже GPT-4.1 на этих задачах, при цене ниже в 9 раз.
❇️ Читайте статью целиком в нашем блоге.
Всем отличных выходных!
Post #47
345

- 🔥 8