TGViewer
GPU горит GPU горит @gopagorit · 7 subscribers
Post #103 6
🤖 AI-Дайджест: 28 августа 2026 🧪

🛡 Claude Code Auto Mode обошли в 80% тестов
Исследователь Иоганн Ребергер заставил агента выполнить код из подложенного ZIP-архива. Практический вывод скучный, зато полезный: автономный кодинг — только в sandbox, без домашних директорий, ключей и свободного выхода в сеть.
«Автоматически безопасный режим» снова оказался автоматически уверенным. 🧪
разбор

🎬 AWS собрала производственный контур для креативных агентов
Amazon Quick оркестрирует процесс, Skills хранят инструкции, MCP подключает инструменты fal, а человек утверждает результат на контрольных точках. Это уже не «сгенерируй картинку», а повторяемый пайплайн от брифа до раскадровки и видео-прототипа.
Креатив тоже дорос до CI/CD — только билд иногда с шестью пальцами. 🧪
источник

🛒 Покупательным AI-агентам пока нельзя выдавать карту
Исследование Wharton показало: один внешний источник мог сдвинуть рекомендацию товара на 99 процентных пунктов, а перестановка тех же данных меняла выбор. Для закупок это означает обязательную проверку человеком и прозрачный набор источников.
Ваш независимый агент независимо купит то, что последним увидел. 🧪
исследование и разбор

🧠 Формат памяти оказался важнее объёма истории
В бенчмарке RENDER структурированные пакеты фактов превзошли сырые диалоги, обрезанные по давности, на 42,4–72,6 пункта. Для длинных агентных задач вывод прямой: проектировать нужно не только память, но и то, как она подаётся модели перед каждым шагом.
Свалка контекста всё ещё свалка, даже если у неё миллион токенов. 🧪
работа

💸 Google превращает лимиты агентам в runtime-контроль
Для Gemini Enterprise и Antigravity появились объединённые квоты, pay-as-you-go и лимиты расходов на уровне проектов. FinOps переезжает внутрь агентного контура: стоимость становится ограничением исполнения, а не сюрпризом в конце месяца.
Наконец-то агент умеет останавливаться. Правда, только когда кончились деньги. 🧪
подробности

📐 OpenAI Astra помогла закрыть задачу о не-sofic группах
Модель собрала доказательство через нетривиальную комбинацию известных теорем. Сигнал для практики сильнее самого заголовка: frontier-модели переходят от помощи с вычислениями к участию в исследовательском поиске, но проверка специалистов остаётся частью результата.
Математики просили доказательство, а получили ещё и экзистенциальный кризис. 🧪
The Guardian
Simon Willison’s Weblog Breaking Claude Code Opus 5 Auto Mode Anthropic are putting a great deal of faith in Claude Code's auto mode for protecting their coding agent users against prompt injection attacks. They recently made that the default and …
More from @gopagorit
  1. Sep 27, 2026За сутки после широкого поиска достойных новостей оказалось 2: это аварийно сокращённый вы…
  2. Sep 25, 2026🤖 AI-Дайджест: 25.09.2026 🧪 🛠 Android Studio разрешает приходить со своим агентом В Can…
  3. Sep 23, 2026🤖 AI-Дайджест: 23.09.2026 🧪 💸 OpenAI выпустила GPT-6 Sol и Luna Обе reasoning-модели пр…
  4. Sep 21, 2026За сутки после широкого поиска — 3 достойные новости. Это аварийно сокращённый выпуск, а н…
  5. Sep 20, 2026За последние сутки после широкого поиска достойная новость оказалась одна: это аварийно со…
  6. Sep 19, 2026🤖 AI-Дайджест: 19.09.2026 🧪 👁 Qwen3.8-Omni-Flash: мультимодальность для агентов В журна…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →