За 7 дней две лабы выкатили свои топ-модели. Антропик 16 апреля уронил Opus 4.7. OpenAI ответил 23-го свежим GPT-5.5. Этот пост нужен для новичков которые не знают что им выбрать
Теперь к сравнению:
Где выигрывает Opus 4.7
— SWE-Bench Pro: 64,3% против 58,6%. Это задачи «почини баг в реальном репозитории», и тут Опус заметно впереди.
— Многоязычность: 91,5% против 83,2%. Если пишешь не на английском, разница чувствуется.
— Работа с тулами (MCP): немного, но лучше.
— Доступен везде с первого дня (Bedrock, Vertex, Foundry).
Где выигрывает GPT-5.5
— Terminal-Bench 2.0: 82,7% против 69,4% (Работа в терминале, запуск команд, дебаг).
— OSWorld: агентные задачи, когда модель сама кликает по компу.
— На длинном контексте (от 500К токенов: retrieval у 5.5 на 40 пунктов лучше. Если кидаешь ей огромные доки тогда она реально помнит, что в начале.
Стоит ли с клод кода переходить на гпт?
Короткий ответ - нах надо.
Если ты на Claude и юзаешь его под код, тексты, ресерч. Тогда оставайся. Opus 4.7 в коде объективно сильнее, а для обычных задач разница между топами уже незаметна. Для новичка абсолютно никакой разницы.
Я пока сижу на Claude, потому что скилы у меня уже настроены и опуса вполне хватает.
Напиши в комментах чем сейчас пользуешься и под что?
Channel | Chat | YouTube
