Grok 4.7 должен быть примерно на уровне Opus 5.0, а не 5.1. В чём-то лучше, в чём-то хуже. Нужно чинить мультимодальную производительность.
Grok 4.8 будет заметным улучшением.
Grok 4.9 станет, скорее всего, класса Astra/Fable.
Grok 5, возможно, получится лучше всего существующего. Посмотрим.
⏳Сроки:
4.7 заканчивают обучение, она уже должна была выйти, но возникли проблемы с RL. Ориентировочно выйдет на этой или следующей неделе.
4.8 судя по темпам не раньше начала октября, оптимистично.
💡 RL — очень важный процесс обучения современных моделей. Если вы видите этот термин в первый раз, ознакомьтесь:
Reinforcement Learning (RL) — обучение с подкреплением: нейросеть пробует разные действия, получает за результат награду или штраф и постепенно учится выбирать то, что приносит больше награды.
Например, нейросеть играет в игру: сначала действует случайно, за победу получает награду, за поражение — штраф. После множества попыток вырабатывает стратегию — хотя никто не показывал ей правильный ход в каждой ситуации.
У языковых моделей аналогично: ответы оценивают люди или автоматические проверяющие, а обучение повышает вероятность ответов с высокой оценкой.
Главная тонкость — правильно задать награду. Иначе модель научится получать высокий балл, а реальная задача останется нерешённой.