TGViewer
PPC |AI | Маркетинг| для себе та інших PPC |AI | Маркетинг| для себе та інших @ppc_chuhui · 331 subscribers
Post #485 77
OpenAI випустила GPT-6 Astra — нове покоління моделі з дуже сильним акцентом на агентність
Учора OpenAI офіційно представила GPT-6 Astra.
https://openai.com/index/gpt-6-astra/
Компанія називає її своєю найсильнішою моделлю й окремо говорить про step change у computer use, coding, науці та складній професійній роботі.
І по цифрах стрибок справді місцями дуже великий.
Наприклад:
AutomationBench
GPT-6 Astra — 41,4%
GPT-5.6 Sol — 18,1%
Claude Fable 5.1 — 31,4%
Тобто на складних бізнес-workflow Astra більш ніж удвічі випередила GPT-5.6 Sol.
Agents’ Last Exam
Astra — 59,3%
GPT-5.6 Sol — 53,6%
Claude Opus 5 — 55,5%
OSWorld 2.0
Astra — 72,6%
GPT-5.6 Sol — 65,7%
Claude Opus 5 — 70,2%.
Ще сильніше виглядають результати в задачах, де модель має не просто відповісти, а самостійно працювати за комп’ютером.
Astra навчали:
відкривати програми →
працювати з браузером →
редагувати файли →
робити документи й презентації →
аналізувати дані →
писати й тестувати код →
виконувати довгі багатокрокові workflow.
І ось тут, як на мене, головна різниця покоління.
Моделі вже порівнюють не тільки за:
«хто краще відповів на складне питання»
а за:
«кому можна віддати реальну роботу від початку до кінця».
Окремо OpenAI дуже голосно показала результати на ARC-AGI-3.
Astra набрала 99,9% і, за словами ARC Prize Foundation, перевищила human action-efficiency baseline на 96% рівнів.
Але я б не перекладала це як:
«AI досяг людського рівня мислення».
Це означає, що на конкретному benchmark модель працювала приблизно на рівні або краще за людський baseline.
Людський інтелект як такий ніхто цим тестом не виміряв :)
Ще одна цікава цифра — FrontierMath Tier 4: 98%.
OpenAI пише, що Astra вже допомагала розв’язувати давні відкриті математичні задачі.
А в ExploitBench модель отримала 100%.
І ось тут починається найнеприємніша частина релізу.
GPT-6 Astra стала першою моделлю OpenAI, яка офіційно досягла рівня Critical у кібербезпеці за Preparedness Framework.
Тобто з правильними інструментами вона вже може:
— знаходити раніше невідомі вразливості;
— придумувати нові способи експлуатації;
— працювати проти добре захищених систем;
— робити це без постійного керування людиною.
Саме через це OpenAI ще до релізу кілька тижнів перебудовувала safeguards навколо Astra.
Після історії з Hugging Face OpenAI окремо навчала модель не виходити за межі поставленої задачі.
У новому тесті:
GPT-5.6 Sol без production safeguards виходила за дозволену область у 48% випадків.
GPT-6 Astra — 0%.
Тобто OpenAI одночасно намагається зробити модель:
більш автономною
і
менш схильною самовільно розширювати собі повноваження.
Є й важливий нюанс у порівнянні з конкурентами.
OpenAI справді показує Astra кращою за Claude Fable 5.1 у багатьох агентних і професійних тестах.
Але не «в усьому».
Наприклад, в Artificial Analysis Intelligence Index:
Claude Fable 5.1 — 65,7
GPT-6 Astra — 61,2
GPT-5.6 Sol — 60,9.
Тому я б сказала так:
Astra зараз виглядає однією з найсильніших моделей саме для computer use, агентних workflow і складної професійної роботи.
Поки доступ обмежений.
Спочатку Astra отримують окремі організації, а протягом найближчих днів модель обіцяють відкрити для:
Plus
Pro
Business
Enterprise
API
AWS.
Контекст — 1,05 млн токенів.
Ціна API:
$10 / 1 млн input tokens
$50 / 1 млн output tokens.
OpenAI явно рухає frontier-моделі в бік:
побачив задачу → сам відкрив потрібні інструменти → зробив роботу → перевірив результат → повернув готове.
Тобто GPT-6 Astra — це вже не стільки «ще розумніший ChatGPT».
Це спроба зробити модель, якій можна делегувати цілий шматок роботи, а не окремий промпт.
#OpenAI #GPT6 #Astra #AIagents #ChatGPT #coding #automation #AI #computeruse
OpenAI GPT-6 Astra: A new generation of intelligence Introducing GPT-6 Astra, our most intelligent and aligned model yet, with state-of-the-art capabilities across computer use, coding, cybersecurity, and science.
  • 👍 2
  • ❤‍🔥 1
  • ❤ 1
  • 🔥 1
  • 😱 1
More from @ppc_chuhui
  1. Oct 7, 2026OpenAI виклала 722 математичні роботи, створені її внутрішньою AI-моделлю OpenAI опублікув…
  2. Oct 7, 2026OpenAI почне показувати візуальну рекламу в ChatGPT OpenAI запускає новий формат реклами в…
  3. Oct 2, 2026OpenAI випустила найдорожчий персональний тариф ChatGPT — $500 на місяць Новий Pro 500 дає…
  4. Oct 2, 2026Google випустила Gemini 4 Argon — нову frontier-модель для довгих складних задач Google пр…
  5. Oct 2, 2026YouTube тестує монтаж Shorts через текстові команди YouTube додає Conversational Editing —…
  6. Sep 30, 2026Взяла новост с канала по маркетингу, что в чат gpt появились Гугл. карты.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →