Думаєте це все? А херушки нам всім😅 вслід за антропіками і OpenAI «стрільнула» дзеркально.
OpenAI випустила GPT-6 Sol та GPT-6 Luna.
GPT-6 Sol — основна потужна модель для складної професійної роботи.
GPT-6 Luna — швидша та значно дешевша модель, яка при високому reasoning несподівано близько підібралася до великих моделей.
Менше галюцинацій
За тестами OpenAI, GPT-6 Sol робить приблизно вдвічі менше фактичних помилок, ніж GPT-5.6 Sol.
Для користувача це означає менше впевнених вигадок про неіснуючі функції, API, бібліотеки та факти.
Сильніший coding
На DeepSWE 1.1:
GPT-6 Sol max — 68.8%
GPT-6 Luna max — 66.6%
І це одна з найцікавіших частин релізу: бюджетна Luna вже досить близько до Sol у coding-задачах.
Luna можна використовувати для routine coding, рефакторингу та feature-level задач. Sol залишається кращим вибором для складного debugging, архітектури та великих codebase.
Кращі AI-агенти та Computer Use
GPT-6 суттєво покращилася в задачах, де модель повинна не просто відповісти, а самостійно виконати послідовність дій через інструменти.
На OSWorld 2.0:
GPT-6 Sol xhigh — 60.5%
Claude Opus 5 medium — 60.3%
Тобто модель краще працює за схемою:
побачити → зрозуміти → виконати → перевірити → адаптуватися
Це особливо важливо для ChatGPT Work, Codex та автономних AI-агентів.
Luna стала значно цікавішою
Стара логіка:
маленька модель = швидка, дешева і слабка
поступово перестає працювати.
Тепер:
менша модель + великий reasoning budget = дешево, але потенційно дуже розумно
У деяких задачах Luna з високим reasoning уже наближається до значно дорожчих моделей попереднього покоління.
Моделі чесніші щодо виконаної роботи
GPT-6 Sol та Luna рідше заявляють Tests passed, якщо насправді тести не запускалися.
Моделі краще розрізняють те, що вони реально перевірили, і те, що лише припускають. Для coding agents це дуже важливе покращення.
Покращили Prompt Caching
GPT-6 ефективніше кешує великий контекст: документацію, repository, історію діалогу та результати tool calls.
Cached input отримує 90% знижки, а зміна reasoning effort або доступних tools більше не обов’язково руйнує кеш.
Це означає дешевші та потенційно швидші довгі сесії з AI-агентами.
І головне — ціна
GPT-6 Sol:
Input — $2 / 1M tokens
Output — $10 / 1M tokens
Це приблизно вдвічі дешевше за GPT-5.6 Sol.
GPT-6 Luna:
Input — $0.10 / 1M tokens
Output — $0.50 / 1M tokens
Тому сімейство тепер можна умовно розділити так:
Luna — швидкість, автоматизації, повсякденні задачі та routine coding.
Sol — складний coding, debugging, architecture, research та серйозні агентні задачі.
Astra — максимум можливостей для найскладніших задач.
І саме GPT-6 Luna може бути найцікавішою частиною релізу: за дуже низької ціни вона вже підбирається до можливостей моделей, які ще зовсім недавно вважалися флагманськими.
Post #1659
979
- 🔥 15