GPT-5.2 Thinking против Gemini 3 Pro: что выбрать разработчику?
Конец 2025 года принес нам долгожданный паритет. Google наконец-то выкатила модель, которая не просто дышит в спину OpenAI, а в некоторых сценариях нагло обходит её на поворотах. Мы изучили тесты обеих новинок — от архитектуры до вайб-кодинга — и вот что нужно знать инженерам.
🧠 Логика и Код: Кто пишет чище? На бумаге (в бенчмарках) GPT-5.2 Thinking — абсолютный монстр с 100% в математическом AIME. Но в реальном кодинге ситуация тоньше:
GPT-5.2 (Стиль «Over-engineering»): На просьбу написать виджет карты выдала сложный код с 3D-эффектами и поворотами. Красиво? Да. Работает? Нет, поехала вёрстка на простых инпутах. Типичный сеньор, который увлекся архитектурой и забыл про CSS-grid.
Gemini 3 Pro (Стиль «MVP»): Код чище, короче (371 строка против 683), но с классической «галлюцинацией» — попыталась подтянуть картинку по несуществующему URL.
Серый кардинал: Иронично, но в чистом кодинге (SWE-bench) обе модели всё еще проигрывают Claude Opus 4.5. Если вам нужен просто рабочий код, Anthropic пока держит корону.
👀 Мультимодальность: Зрение против Контекста Здесь философия моделей расходится кардинально. В тесте на распознавание иконок (без подписей) GPT-5.2 вела себя как OCR-движок: долго думала, нарезала картинку, анализировала пиксели. Результат точный, но процесс мучительный. Gemini 3 Pro схитрила: она прочитала название файла, поняла бренд техники и подтянула документацию из своей базы знаний. Для разработчиков AI-агентов это важный сигнал: Gemini лучше работает с контекстом, а не только с сырыми данными.
⚠️ Особенности эксплуатации
Контекстное окно: Gemini предлагает царский 1 млн токенов против 400к у GPT. Для скармливания документации или больших логов Google сейчас вне конкуренции.
Цензура и «Вайб»: GPT-5.2 стала совсем «корпоративной». Она отказалась писать сатирический стих (якобы нарушение прав стиля), выдав пресную инструкцию. Gemini задачу выполнила, хоть и кринжово. Если вы используете LLM для креатива или генерации нестандартных данных — OpenAI может душнить.
🎯 Итог для разработчика GPT-5.2 Thinking — это ваш идеальный стажер-отличник. Надежный, знает матан, но шаг влево-вправо от инструкции вызывает ступор или оверинжиниринг. Идеально для рефакторинга и документации.
Gemini 3 Pro — талантливый, но хаотичный сеньор. Она поймет схему на салфетке, нарисует диаграмму в ответ и распарсит огромный дамп логов. Но готовьтесь к танцам с бубном ради доступа (Google жестко банит по IP).
Post #76
40

- ❤ 2
- 👍 2