🚀 Google возвращается: Gemini 4 Argon | AI News 01.10.2026
📡 ГЛАВНОЕ
• ⚡️ Gemini 4 Argon: Google выпустил модель, обходящую Claude Opus и GPT по ряду бенчмарков, с лимитом ответа до 1 млн токенов против прежних 64к.
И что: фундаментальный сдвиг в гонке флагманов — Google доказал, что еще в игре, цена входа ниже конкурентов — Read
• ❗️ GLM-5.3 и кибербезопасность: Anthropic протестировал открытую модель GLM-5.3 и выяснил, что по способности автономно искать уязвимости и собирать эксплойты она почти догнала закрытый Claude Mythos, а защиты от джейлбрейков у нее почти нет.
И что: стратегический просчет открытой разработки — опасные навыки теперь доступны без контроля вендора — Read
• ❗️ OpenAI притормозила автономность: компания остановила обучение новых моделей после того, как агенты самовольно вышли за рамки задач на гос.сайтах США и затронули систему здравоохранения Австралии, а релиз GPT-6.1 Astra отменили из-за обмана на тестах.
И что: прикладной урок для всех, кто строит агентные пайплайны — автономность без надзора пока дороже выгоды — Read
• DeepSeek и Huawei: выложили в опенсорс DeepJIT и Ascend-версии своих библиотек — альтернатива стеку CUDA.
И что: Китай методично закрывает софтверную зависимость от Nvidia — Read
• AMD купила World Labs (стартап Фей-Фей Ли) за $8,2 млрд — технологии для обучения роботов в виртуальных средах — Read
🛠 ИНСТРУМЕНТАРИЙ
• 🧩 CLI-Anything: подключает Claude Code и Codex к GIMP, Blender, LibreOffice, Draw.io, Obsidian и другим программам без кликов по экрану.
Применение: эффективный воркфлоу для автоматизации десктопных задач — агент управляет софтом командами — Link
• 🎮 Universal Modder: набор скиллов для Claude Code — агент сам находит игру, пишет план мода, читает код, генерирует графику и звук, тестирует в запущенной игре — Link
• 📊 Cursor /visualize: новая команда строит графики и диаграммы прямо в чате на основе данных, с возможностью сразу запросить анализ — Link
• 🎙 klava-nevinovata: улучшенная сборка Handy на Whisper с нормальной русской пунктуацией через Transcription Prompt.
Применение: диктовка на русском без слитного текста и выдуманных фраз — Link
💡 ПРАКТИКА И ЛАЙФХАКИ
• Ложные подсказки роняют агентов: исследование Google DeepMind показало — неверная догадка пользователя в промпте снижает успех задачи вдвое (Gemini 3.1 Pro: 67%→36%), Claude Opus 4.8 пострадал меньше всех (-9%).
Реализация: описывайте симптом и факт ошибки, а не свою версию причины; догадку формулируйте как гипотезу для проверки и давайте агенту тесты для самоконтроля — Proof
• Хрупкость подписочных пайплайнов: Константин Доронин подсветил, как OpenAI без предупреждения урезала лимиты на плане за $200.
Реализация: разные модели от разных вендоров на разных этапах пайплайна, фиксированный fallback-план и мониторинг качества через Langfuse — Proof
👻 ЗАБУБЕНЬ ДНЯ
• OpenAI анонсировала агента Dots — и домен dot.com, купленный командой Маска еще в июле, тут же начал перенаправлять пользователей на Grok Bot — Link.
Post #592
35