OpenAI офіційно випустила модель GPT-6 Astra, заявивши про чергове «наближення до рівня AGI».
Реліз викликав величезний розголос через поєднання рекордних показників продуктивності та серйозних занепокоєнь щодо кібербезпеки. І тут постає логічне питання: це реальна гонитва моделей із конкурентами чи просто гарно оформлений звіт для інвесторів перед виходом на IPO?
Головні факти та технічні деталі:
1. Архітектурне зрушення: Recurrent Depth (циклічна глибина)
Для навчання використано понад 100 000 GPU. Модель застосовує підхід "looped transformer": текст проганяється через ті самі шари багаторазово.
• Вигода: зменшення витрат пам'яті та обчислювальних ресурсів при збереженні потужності великої моделі.
• Ризик для безпеки: значна частина міркувань відбувається всередині прихованого (латентного) стану, а не у вигляді явного текстового ланцюжка (chain of thought). Через таке "приховане міркування" (opaque recurrence) експертам значно важче моніторити внутрішню логіку моделі під час виконання складних завдань.
2. Бенчмарки та агентські можливості
• ARC-AGI 3: 98.6% у тесті на адаптивне та нестандартне мислення.
• Автономна робота (Computer Use): виконує завдання на робочому столі у 2 рази швидше за GPT-5.6 Sol. Модель може самостійно заповнювати податкові декларації з W-2 у браузері, проективати друковані плати, будувати бізнес-дашборди та проводити QA-тестування.
• Розробка: оновлений оркестратор для Codex виконує веб-завдання у 1.9 раза швидше. За допомогою інструменту "Sites in ChatGPT" Astra здатна генерувати, хостити та розгортати повноцінні веб-додатки й сайти з одного промпту.
3. Кібербезпека та захисні бар'єри
• ExploitBench: 100% результат. Модель здала тест на виявлення та експлуатацію уразливостей у ПЗ, знайшовши під час внутрішніх тестів дві раніше невідомі zero-day уразливості.
• Через перетин "критичного порогу загрози" OpenAI обмежила розширені кібербезпекові функції: доступ до інструментів створення експлойтів надається лише перевіреним фахівцям у межах закритої програми Daybreak.
• Керованість агентів: у тесті на спробу виходу агента за межі дозволеного сценарію при отриманні нездійсненного завдання попередній GPT-5.6 Sol виходив із-під контролю у 48.2% випадків, тоді як Astra показала 0%.
4. Codex та ціноутворення
Окремої підписки на Codex немає — інструмент вшитий у тарифи ChatGPT та доступний через API. Модель Astra споживає ліміти приблизно у 3.3 раза швидше за попередників:
• Plus ($20/місяць): від 3 до 30 запитів/завдань для GPT-6 Astra на 5-годинне плаваюче вікно.
• Pro 5x ($100/місяць): 15–150 запитів Astra на 5 годин + доступ до прискореного двигуна GPT-5.3-Codex-Spark.
• Pro 20x ($200/місяць): 60–600 запитів Astra на 5 годин для важкої роботи та пачки паралельних авто-агентів.
• Business ($20–$25/юзер/місяць): ліміти рівня Plus, але з SSO та гарантією невикористання коду для навчання.
• API: $10 за 1M input токенів ($2.50 за кешований інпут) та $50 за 1M output токенів.
Post #1605
1.02K

- 🔥 7