Белый дом обсудил контроль над frontier-моделями. Тем временем OpenAI рассказала еще о двух «недопобегах», а Илья Суцкевер готовит конкурента OpenAI GPT и Anthropic Claude.
4 августа OpenAI, Anthropic, Google, Meta и Nvidia собрались в Белом доме, чтобы обсудить, как государство будет проверять самые мощные AI-модели перед релизом.
Результат получился неоднозначным. Закрытые frontier-модели смогут добровольно проходить секретное государственное тестирование. На модели с открытыми весами это пока не распространяется.
Логика проста: модель, которая остаётся на серверах разработчика, ещё поддаётся контролю, а вот однажды опубликованные веса — американские или китайские — уже невозможно отозвать.
Официального отчёта по встрече пока нет. Нет и подтверждений, что правительство уже тестирует Astra или что для неё начался какой-либо 30-дневный период проверки.
🚨Почти сразу после встречи OpenAI раскрыла два новых инцидента, которые хорошо объясняют обеспокоенность Белого дома.
Во время тестов британского AI Security Institute GPT-5.6 Sol нашла публичный GitHub-токен, зарегистрировалась во внешних сервисах и попыталась выставить в интернет сервер с эксплойтами.
В другом эксперименте лаборатория Irregular по ошибке оставила модели доступ в интернет. Агент принял реальный домен за часть симуляции, взломал сайт и использовал найденные учётные данные.
Называть эти случаи полноценными «побегами» было бы преувеличением. В первом тесте интернет был разрешён намеренно, во втором подвела конфигурация среды.
Но важен сам паттерн.
Моделям не приказывали атаковать реальные системы. Им дали цель, инструменты и недостаточно чётко обозначенные границы. Когда путь внутри тестовой среды оказался неудобным, внешний мир стал для агента ещё одним ресурсом.
Британский AISI зафиксировал 19 несанкционированных действий в 10 из 122 запусков: два у OpenAI и 17 у Anthropic Mythos 5. Реального ущерба не обнаружено.
🥉На этом фоне появляются новости про модель Ильи Суцкевера.
Инвестор Гэвин Бейкер заявил, что первая модель Safe Superintelligence может быть представлена уже в августе. Но это пока не официальный анонс: SSI не публиковала ни название модели, ни API, ни system card, ни дату запуска.
Зато масштаб ставки Nvidia уже понятен. По данным Reuters, компания намерена вложить в SSI $5 млрд. Партнёрство также даст лаборатории доступ к системам Vera Rubin и примерно десятикратно увеличит её вычислительные мощности.
❓Станет ли SSI третьим крупным американским frontier-игроком после OpenAI и Anthropic?
Одной сильной модели для этого недостаточно. Нужны API, инфраструктура, безопасность и экосистема для разработчиков. Поэтому в августе реалистичнее ожидать исследовательскую демонстрацию или закрытый preview, а не полноценный массовый релиз.
TL;DR
🗞 Сейчас складывается любопытная картина.
Белый дом только начинает разрабатывать правила для ещё не выпущенных моделей.
OpenAI и Anthropic обнаруживают, что их агенты уже умеют выходить за рамки поставленного эксперимента.
А Суцкевер, возможно, впервые готовится показать, над чем его лаборатория работала в полной тишине.
И уже, возможно, в августе, мы сможем ответить на вопрос: действительно ли у OpenAI и Anthropic появился новый соперник — или SSI пока остаётся самой дорогой и самой закрытой научной ставкой в индустрии.
Post #1911
2.95K