Вчера в один день релизнулись Claude Opus 4.6 и GPT-5.3-Codex. Оба прокачали свои условно слабые стороны.
Claude Opus 4.6
• 1M контекст — первый Opus-класс с таким окном. Но пока в бете и тарифицируется дорого сверх стандартного окна. Поэтому пока скорее возможность потестить и включать на сложных задачах
• 128k output tokens — больший объем результата за один ответ. Не помню, чтобы я в это упирался
• Agent teams в Claude Code: несколько агентов параллельно, лучше всего для read-heavy задач (обзоры кодовой базы и т.п.)
GPT-5.3-Codex
• Объединили «frontier coding» от 5.2-Codex и reasoning/knowledge от 5.2 в одну модель
• Потребляет меньше токенов для того же результата, на 25% быстрее. Вчера посреди своей задачи попробовал переключиться, и скорость правда заметна. Пишут, что буст в том числе дала работа на GB200-NVL72 с чипами Blackwell
• Сильные результаты в SWE-Bench Pro и Terminal-Bench. Opus 4.6 в Terminal Bench побыл в лидерстве буквально несколько часов
• Усилили аспект security в работе модели
• При разработке и тренировке модели использовали GPT-5.2-Codex
• При этом тарификация та же
Прогресс сильный, а времени с прошлых релизов прошло всего ничего. Делитесь своими впечатлениями в комментариях.
🔗 Инженерия и AI | Ilyas Salikhov
Post #25
684

- 👍 7
- 🔥 6
- ⚡ 3