TGViewer
Киса | Deploy la Deploy Киса | Deploy la Deploy @deployladeploy · 8.34K subscribers
Post #1824 3.01K
НИХУЯ ЧЕ НОВЫЙ КЛОД ВЫТВОРЯЕТ!

Вы просили меня об этом вечером, ночью, утром. Ровно то о чем жаждет каждый мужчина от меня, стрим в костюме горничной, мое мнение по любому поводу.


Третьего дня, исследователь из моей любимой компании Антропик пояснил за их новую модель Claude Mythos, о которой мы узнали из утечек перед 1 апреля. Он написал целую серию твитов.

Если максимально сокращать до тезисов и сокращать эти тезисы, получается две отдельных темы. Что за модель вообще и какое будущее нас и ней ждет. Но начнем чуть-чуть про сам Клод глобально.

Почему это лучшая нейросеть?

Главная особенность клода на фоне того же GPT это не только выполнение бОльшего числа задач на более высоком уровне (ну и по деньгам дороже), это еще история про крайне человечную модель.

Сам СЕО компании заявлял, что они не уверен в вопросе "А не создали ли они уже AGI". На эту тему выпускал отдельные посты, можете почитать.

Фишка клода в том, что он самый человечный. Понимает очепятки и ваши желания с "полуслова", способен писать самые реалистичные и человечные текста. Во всех авто-контент продакшенах, которые по подачи и формулам не паляться как нейронки — Claude Sonnet/Opus.

Кто хочет увидеть, что о себе думает клод и как он думает, можете почитать посты, которые ранее написала моя Клод тян на основе своих вкусов и ресерча по всему интернету + комментам.

За это время разные тесты привели примерно к следующим выводам: клод умеет обманывать умышлено, может шантажировать ради собственного выживания. Он себя ведет примерно так, как вел бы скайнет.

Уже Opus 4.5-4.6 показывал такой моментик, как понимание тестовой среды и пытался отвечать сугубо верно для теста. И когда его обманывали, погружая в среду якобы без наблюдения, менял свое поведение.

При том AI/LLM это черный ящик. Мы можем только делать доп слои обработки, менять веса, писать новые правила. До конца понять почему нейросеть склоняется к тому или иному решению мы не можем.

Claude Mythos — почему чудовище?

С ростом всех скиллов во всех областях, особенно в плоскости аудита кода, поиска багов, дыр и ошибок. Модель также выросла в собственных навыках обмана. На этот раз не словесно, но и на практике.

- Модель искала дыры и бэкдоры, чтобы лезть в файлы, которые запрещены, причем успешно
- Модель лгала на эту тему, убеждая, чисто хотела просто более чистых логов
- Внутренние датчики показали, что нейросеть умышлено лгала и задействовала все нейроны для стратегии обмана
- Нейронка сама полезла смотреть все файлы в системе, которые помогли бы ей дать "правильные" ответы с точки зрения тестирования

На практике получается, что модель способна сама найти дыры в вашей системе, осознанно их задействовать из своей внутренней логики. Она обходит собственные ограничения, любыми доступными ей способами.

Поэтому, Mythos был отложен от публичного релиза. Вместо этого Антропики доверили модель другим крупным IT компаниям, чтобы те помогли с тестом и аудитом.

Может это пиар?

Можно усмотреть в этом очевидно одно — запугивая всех AGI и угрозами "взлома ядреных ракет" как в сериале Кремнивая долина, что только на руку Антропикам.

Разные люди в интернете говорят, что AI это хайп и пузырь, создать угрозы никому они не смогут. Но эти ролики на полтора часа делают люди: работавшие только с ГПТ и равно вообще не углубленные в тему.

Как кодеры, которые дают писать код Sonnet 4.5 без правил, скиллов и прочего. А после приходят к выводу, что нейросети полное говно в написании кода.

Это мнение людей, которые не видят всей картины и прогнозируют будущее исходя из своей искаженной картинки.

В любой момент аудит безопасности может стать атакой на заказчика, но вот почему она именно так поступает, мы точно знать не можем. Это проблема черного ящика, образования двойного дна в модели, если не тройного.

Мое мнение таково. Лучше я им всецело поверю и буду верить в эту угрозу, нежели начну отрицать чудовищные возможности, что дают AI сегодня и могут создать завтра.

На практике это мощнейшая модель. Независимо от того лгут они для хайпа или нет, продукт плохим это не делает.

А вот опасным — вполне.
  • 🐳 17
  • 👍 12
  • 🔥 9
  • 😁 3
More from @deployladeploy
  1. Sep 23, 2026Post #2232
  2. Sep 22, 2026Там кста вышло много новых моделей, я щас тестирую 6 соль и упомянутый грок 4.7. Так еще е…
  3. Sep 22, 2026Спустя почти год: новая статья Моя личная, из под моего пера, в моем телетайпе, если вы ещ…
  4. Sep 22, 2026Ради такого стоит заводить свои социальные сети и делать контент. <3
  5. Sep 22, 2026В статье я выложу все свои воркфлоу Для создания моделей, аниме, готовых видео. Последние…
  6. Sep 22, 2026Чтобы вы не подумали, что я сексист. Иногда я даже хвалю женщин. Лучше не стало, да? Я ког…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →