You do not need God to write your emails
Наткнулся на разбор от Lindy. Они для своего ИИ-ассистента съехали с Claude на DeepSeek и срезали расходы на инференс примерно на 90%. Качество не просело.
Мысль засела: для рутины не нужна самая дорогая модель. Письмо, саммари, разбор почты, это не та задача, где платишь за гения.
Но фокус не в том, чтобы тупо воткнуть модель подешевле. На голом промпте дешёвая обычно тупит. Они докрутили промпты через GEPA. Это когда не руками подбираешь формулировки, а гоняешь промпт против набора тестов, пока он не вытянет нужное качество уже на слабой модели.
Хочу сам пощупать. У меня в сервисах полно мест, где крутится фронтир-модель на задачах, которым хватило бы модели попроще. Потенциально это минус десятки процентов от счёта без потери качества.
Заодно проверю, где обещанные 90% превращаются в реальность, а где модель ломается так, что лучше переплатить.
Расскажу, что выйдет.
Post #843
575
- 👍 3
- ❤ 2
- 🔥 1