GPT-5: ожидания vs реальность 🤔
Потестил новую модель - честно говоря, разочарован. В реальных задачах по программированию и логическим рассуждениям GPT-5 ощущается максимум как o3, а местами даже слабее.
Что пошло не так с релизом:
- Сам запуск OpenAI назвала "bumpy" (неровным)
- Альтман признал "mega chart screwup" с диаграммами на презентации
- Противоречивые отзывы в прессе
Цифры vs практика:
На бумаге прогресс есть - SWE-bench Verified показывает 74.9% против 69.1% у o3. Но в реальной работе этого не чувствуется. Более того, в некоторых задачах результат хуже.
Мое решение:
Переключаюсь на Claude. Последние тесты показывают его превосходство, да и бенчмарки это подтверждают. Пора дать ему шанс в продуктивных задачах.
А какой ваш опыт с новыми моделями?
Post #135
1.01K

- 👍 8
- 🔥 3
- 😭 2
- 🤔 1