В чан дебат про дистиляцию моделек
Чем более синяя точка тем модель менее удивлена видеть ответ другой модели (сиречь распределение токенов в ответе),чем более желтая->серая - тем более для модели ответ непривычен, что кагбэ говорит нам о том, что в датасет не попадали такие ответы.
График явно намекает на то что Кими вообще не удивлена видеть ответы опусов, даже в сравнении со своими предыдущими версиями.
Великие умы думают одинаково, чо.
Кстати это также довольно наглядный пример почему валидировать ответы ллмки лучше моделью из других семейств, а не той же самой.
Post #449
276

- 🤔 3
- 👍 1