🤖 Гонка LLM: Opus 5.5 и GPT-6 дешевле | AI News 23.09.2026
📡 ГЛАВНОЕ
• ⚡️ Opus 5.5: Anthropic выпустила модель на 30% быстрее и на 40% дешевле Opus 5, обходит Fable 5.1 в агентном кодинге.
И что: топовый агентный интеллект в API за $20/M output вместо $25 — порог входа в сложные агентные системы падает — Read
• ❗️ 100 открытых задач: внутренняя модель OpenAI за месяц обучения решила более 100 математических задач, включая гипотезу Ходжа и Навье-Стокса.
И что: независимой проверки решений пока нет, а созданная OpenAI консультативная группа математиков не может влиять на темп исследований компании — Read
• ❗️ Ложный отчёт ИИ: чат-бот сообщил разведке США, что китайское судно везёт компоненты ядерной программы — военные готовились к перехвату, вывод оказался ложным.
И что: Пентагон внедряет ИИ в разведку быстрее, чем выстраивает проверку его выводов — Read
• GPT-6 Sol и Luna: OpenAI ответила на Opus 5.5 новыми моделями, снизив цены в 2–10 раз — Luna теперь $0,1/$0,5 за млн токенов.
И что: стоимость топового агентного интеллекта падает на порядок за месяцы — Read
• MiMo-2.6 от Xiaomi: открытая модель уровня Opus 5 и GPT-5.6 Sol обучена за $3 млн на верифицируемых задачах, веса в опенсорсе.
И что: открытые модели почти догоняют closed-source топ при цене $0,435/$0,87 за млн токенов — Read
🛠 ИНСТРУМЕНТАРИЙ
• 🎯 Jev от TypeSafe: модель класса "System One" не пишет текст, а сразу отдаёт структурированное решение — выбор, оценку или вероятность 0–1 за 70–500 мс и $0,042 за млн входных токенов.
Применение: маршрутизация тикетов поддержки, классификация писем, фильтр контента — там, где раньше ради простого выбора гоняли полноценную LLM — Link
• 🗂 Обновлённые Projects в Claude: сам разбивает цель на подзадачи, выполняет параллельно и хранит общую память проекта между чатами — Link
💡 ПРАКТИКА И ЛАЙФХАКИ
• Агентный пентест Hacktron: команда за трое суток вместе с Claude нашла в форуме OpenAI дырку через конвертер HEIC-файлов и с помощью Opus 5 написала эксплойт, добравшийся до чужих аккаунтов ChatGPT и Codex.
Реализация: модель поначалу отказывалась писать эксплойт-код — согласилась, когда задачу переформулировали как конкурсную; OpenAI выплатила $6500 — Proof
• Метод Сократа через LLM-классификатор: Алексей Каптерев прогнал 2000 вопросов из 10 диалогов Платона через классификатор и выяснил, что 45% реплик Сократа — подведение собеседника к фактам-посылкам, с которыми легко согласиться.
Реализация: итеративное уточнение категорий классификатора на каждом новом диалоге вместо готовой таксономии с самого начала — Proof
👻 ЗАБУБЕНЬ ДНЯ
• Трамп на Генассамблее ООН официально переименовал искусственный интеллект в "Superior Intelligence" — реального ИИ переименование не касается — Link
Post #584
32