Поддержали вышедшую вчера серию GPT-5.6 моделей (и новые особенности и детали протокола OpenAI) в нашем AI Hub: Sol, Terra и Luna.
Модели, по первым впечатлениям – замечательные: устанавливают новый фронт Парето на большинстве бенчмарков. С одной стороны – в 3 раза более дешевая альтернатива Fable (Sol), с другой – более дешевая альтернатива GLM (!!!, Luna). Подробный анализ – у Artificial Analysis.
Факт, который понравился больше всего мне – это то, что это первые модели, добившиеся ненулевых результатов в ARC-AGI-3, и даже выиграли одну игру:
Sol at max reasoning effort is the only performant model (as of July 2026) averaging 13.33% on Public and 7.78% on Semi-Private. It is the first model to win an ARC-AGI-3 public game (ft09, 87%).
Бонус: поддержали фишечки, необходимые для корректной работы нового
– @pgregory
