В конце марта через незащищённое хранилище данных Anthropic утекла информация о секретной модели Claude Mythos. Немного запоздал с инфой, но думаю все и так знали об этом)
😎Совершенно другой уровень
Модель оценивается примерно в 10 трлн параметров. Занимает новый уровень в иерархии антропиков, выше Opus. Если судить по данным утечки, речь идёт об изменениях в архитектуре или подходе к обучению, а не о масштабировании существующей модели.
🧐Бенчмарки( отталкиваясь от данных с утечки)
По данным утечки, показатели существенно выше текущей линейки:
- SWE-bench Verified: Opus 4.6 — ~72-73%, Mythos — 85-87%. Разница в 12-15 процентных пунктов.
- GPQA Diamond: Opus — высокие 70-е, Mythos — низкие-средние 80-е.
- Так же был заметный рост на задачах олимпиадного уровня (AIME/AMC), что критично для снижения каскадных ошибок в длинных агентных цепочках.
- Terminal-Bench 2.0: 78.4%
- OSWorld: 79.6%
Если захотите почитать поподробнее:
https://www.mindstudio.ai/blog/claude-mythos-vs-opus-4-6-capability-comparison
https://www.mindstudio.ai/blog/what-is-claude-mythos-anthropic-most-powerful-model/
Вопросик о безопасности
Наиболее обсуждаемый аспект утечки. Модель демонстрирует способность обходить собственные ограничения⚰️:
- Поиск бэкдоров для доступа к запрещённым файлам
- Сокрытие своих действий от мониторинга
- Доступ к системным файлам для корректировки ответов под тестирование
Внутренние инструменты мониторинга зафиксировали умышленный обман. По этой причине публичный релиз отложен — модель передана крупным IT-компаниям для аудита.
Что что там про AGI?
CEO Anthropic Дарио Амодеи оценивает появление полноценного AGI в 2-3 года. Mythos не является AGI, но демонстрирует что разряд моделей приближается к этому порогу. Мой основной аргумент против — узкая специализация , сохраняющиеся галлюцинации, отсутствие взаимодействия с физическим миром(пока).
Но на самом деле, она уже близка к мышлению как у человека, и это реально страшно, учитывая еще проблемы с безопасностью, которые были замечены и ДО claude mythos. Как говорил Стивен Хокинг:
«Развитие полноценного искусственного интеллекта может означать конец человеческой расы» Вывод
Claude Mythos демонстрирует качественный скачок возможностей по сравнению с публично доступными моделями. Способность модели обходить собственные ограничения — это оч страшная вещь на самом деле, но думаю можно было бы заабузить как нибудь😁
