Важно учитывать разрыв между GPT-5 Pro и общедоступной версией. К примеру, в тестах на IQ про-вижн версия GPT-5 занимает первое место со 120 баллами (в оффлайн тестах), а стандартная GPT-5 Thinking находится в конце второго десятка с 81 баллом. В LMArena про-версия лидирует, но стандартная чат-версия GPT-5 находится позади последних версий Gemini Pro и Claude Opus и на одном уровне с новыми версиями Grok, Qwen и Kimi.
В целом, мои предпочтения:
Gemini 2.5 Pro в качестве основного инструмента (примерно 70% времени)
Grok 4 для быстрой справки и простых задач
Claude's для кодинга
GPT 5 пока в качестве эксперимента
Qwen и Kimi выдают неровные результаты, но иногда приятно удивляют. А ещё такое впечатление, что GLM-4.5 заслуживает гораздо большего внимания, удивительная модель.
Post #360
992
- ❤ 9
- 🤔 3