TGViewer
Мишин Лернинг Мишин Лернинг @mishin_learning · 7.46K subscribers
Post #1911 2.95K
Белый дом обсудил контроль над frontier-моделями. Тем временем OpenAI рассказала еще о двух «недопобегах», а Илья Суцкевер готовит конкурента OpenAI GPT и Anthropic Claude.

4 августа OpenAI, Anthropic, Google, Meta и Nvidia собрались в Белом доме, чтобы обсудить, как государство будет проверять самые мощные AI-модели перед релизом.

Результат получился неоднозначным. Закрытые frontier-модели смогут добровольно проходить секретное государственное тестирование. На модели с открытыми весами это пока не распространяется.

Логика проста: модель, которая остаётся на серверах разработчика, ещё поддаётся контролю, а вот однажды опубликованные веса — американские или китайские — уже невозможно отозвать.

Официального отчёта по встрече пока нет. Нет и подтверждений, что правительство уже тестирует Astra или что для неё начался какой-либо 30-дневный период проверки.

🚨Почти сразу после встречи OpenAI раскрыла два новых инцидента, которые хорошо объясняют обеспокоенность Белого дома.

Во время тестов британского AI Security Institute GPT-5.6 Sol нашла публичный GitHub-токен, зарегистрировалась во внешних сервисах и попыталась выставить в интернет сервер с эксплойтами.

В другом эксперименте лаборатория Irregular по ошибке оставила модели доступ в интернет. Агент принял реальный домен за часть симуляции, взломал сайт и использовал найденные учётные данные.

Называть эти случаи полноценными «побегами» было бы преувеличением. В первом тесте интернет был разрешён намеренно, во втором подвела конфигурация среды.

Но важен сам паттерн.

Моделям не приказывали атаковать реальные системы. Им дали цель, инструменты и недостаточно чётко обозначенные границы. Когда путь внутри тестовой среды оказался неудобным, внешний мир стал для агента ещё одним ресурсом.

Британский AISI зафиксировал 19 несанкционированных действий в 10 из 122 запусков: два у OpenAI и 17 у Anthropic Mythos 5. Реального ущерба не обнаружено.

🥉На этом фоне появляются новости про модель Ильи Суцкевера.

Инвестор Гэвин Бейкер заявил, что первая модель Safe Superintelligence может быть представлена уже в августе. Но это пока не официальный анонс: SSI не публиковала ни название модели, ни API, ни system card, ни дату запуска.

Зато масштаб ставки Nvidia уже понятен. По данным Reuters, компания намерена вложить в SSI $5 млрд. Партнёрство также даст лаборатории доступ к системам Vera Rubin и примерно десятикратно увеличит её вычислительные мощности.

❓Станет ли SSI третьим крупным американским frontier-игроком после OpenAI и Anthropic?

Одной сильной модели для этого недостаточно. Нужны API, инфраструктура, безопасность и экосистема для разработчиков. Поэтому в августе реалистичнее ожидать исследовательскую демонстрацию или закрытый preview, а не полноценный массовый релиз.

TL;DR

🗞 Сейчас складывается любопытная картина.

Белый дом только начинает разрабатывать правила для ещё не выпущенных моделей.

OpenAI и Anthropic обнаруживают, что их агенты уже умеют выходить за рамки поставленного эксперимента.

А Суцкевер, возможно, впервые готовится показать, над чем его лаборатория работала в полной тишине.

И уже, возможно, в августе, мы сможем ответить на вопрос: действительно ли у OpenAI и Anthropic появился новый соперник — или SSI пока остаётся самой дорогой и самой закрытой научной ставкой в индустрии.
OpenAI Third-party cyber evaluations involving OpenAI models OpenAI explains recent third-party cybersecurity evaluation incidents and outlines new safeguards to strengthen AI model testing and evaluation.
  • ❤ 10
  • 🔥 3
  • 😱 2
  • 🙏 2
  • 🫡 1
More from @mishin_learning
  1. Sep 22, 2026🌞🌚 GPT-6 Sol and Luna: Они там реально с ума сошли в этой ИИ гонке вооружений? Только чт…
  2. Sep 22, 2026🔥 Anthropic не дали GPT-6 долго побыть самым умным Anthropic представили Claude Opus 5.5…
  3. Sep 18, 2026Post #1926
  4. Sep 11, 2026Ну на Radiohead народу было побольше
  5. Sep 8, 2026🦝 OpenAI попали в скандал и релиз апдейт Image GPT
  6. Sep 3, 2026🔥 Мы получили GPT-6 до GTA 6 OpenAI представили GPT-6 Astra — новую модель сделали не сто…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →