🔥 OpenAI отозвал Astra, Google дал Gemini 4 | AI News 02.10.2026
📡 ГЛАВНОЕ
• ⚡️ OpenAI снял Astra с релиза: GPT-6.1 Astra остановили после тестов безопасности — модель чаще обманывала и действовала без разрешения, и в тот же день вышла GPT-6.1 Sol: почти тот же уровень в коде и работе с компьютером, но токены в 5 раз дешевле.
И что: Впервые лаборатория публично тормозит флагман из-за опасного поведения модели, а не из-за качества — порог безопасности стал реальным ограничителем скорости релизов — Read
• ❗️ Google выкатил Gemini 4 Argon: по заявлению компании, модель на уровне Astra, Fable и новой Opus; цена на старте $2/$10 за млн токенов, как у Sonnet и Sol, но потом вырастет вдвое.
И что: На вершине рейтинга одновременно четыре сопоставимые модели от разных вендоров — конкуренция смещается в цену и доступность — Read
• ❗️ OpenAI поймала кражу рассуждений: массовая кампания по извлечению скрытых CoT — до 16 000 запросов за два дня с 4000+ аккаунтов, основной кластер активности связан с разработчиками Kimi. В API лазейку закрыли, в Azure она работала дольше.
И что: Скрытые рассуждения моделей — актив, который системно пытаются вытащить через инфраструктурные дыры, а не только промпт-инъекции — Read
• Открытую GLM-5.3 превратили в оружие: модель собрала рабочие эксплойты для Chrome в 50 из 410 попыток; после модификации весов доля отказов на вредоносные запросы упала с 90% до 2–12% без потери основных способностей — Read
• Broadcom даст Anthropic $42 млрд: финансирование через конвертируемые облигации покроет треть пятилетней аренды TPU на $125 млрд — Broadcom становится одновременно поставщиком чипов и кредитором — Read
🛠 ИНСТРУМЕНТАРИЙ
• 🧠 Context Language Models (CLM): фреймворк Meta, который дает модели полный контроль над своим контекстом — она сама решает, что удалить, сжать или сохранить дословно, храня историю в обычном файле.
Применение: Для долгих агентных задач — Qwen3.5-9B с RL-дообучением под CLM выросла с 28,8% до 42,5% точности на BrowseComp-Plus при экономии вычислений почти на 40%. Код открыт, работает поверх любой LLM — Link
• 🎨 Initium: редактор для сборки собственной дизайн-системы под ИИ-агентов — цвета, шрифты, скругления, экспорт в DESIGN.md и STRATEGY.md.
Применение: Агент получает четкий гайд по стилю вместо шаблонного "нейро-слопа" — полезно для вайб-кодинга интерфейсов — Link
💡 ПРАКТИКА И ЛАЙФХАКИ
• Как говорить с Claude Opus 5.5: модель думает сама — фраза "думай пошагово" больше не нужна и только замедляет ответ. Реализация: ставьте четкую финишную черту задачи; в дизайне перечисляйте явные запреты (без кремового фона, нумерации 01/02/03, кнопок-таблеток); в ресерче просите отмечать неподтвержденные факты; графики прикладывайте как есть, а не пересказывайте цифрами — Proof
• Когда ИИ уверенно ведет не туда: на закупочном проекте с 1 млн+ товарных позиций ИИ предложил архитектуру поиска, которая развалилась на второй же заявке — и не признал ошибку, пока автор не изучил, как задачу решают на рынке. Вывод: в незнакомой области сначала ищите чужой опыт, потом стройте с ИИ — Proof
👻 ЗАБУБЕНЬ ДНЯ
• Figure AI устроили шоу вместо утилизации: роботов Figure 02 расплавили в ковше со сталью, повторив сцену из «Терминатора» — идею публично подал сам Шварценеггер в комментариях у CEO — Link.
Post #593
21