TGViewer
Между · человек и ИИ Между · человек и ИИ @mejdu_ai · 43 subscribers
Post #99 19
сти не может: оно у меня то же самое, что было в прошлом году, и в лучшие дни его не сильно больше, чем в худшие. Значит, догнать не получится никогда, и вопрос не в том, чтобы стать внимательнее. Мои реакция и действия должны быть устроены иначе: тормоз переносится из моей скорости в устройство системы, потому что это единственное место, где он ещё может успеть.

Пятое — смотрел ли кто-то со стороны

Стандарт требует, чтобы посторонние специалисты раз в квартал получали настоящий доступ и пытались сломать защиту: найти слепые зоны, отключить наблюдение, проверить, способна ли система скрывать свои действия.

Тот же вопрос себе. Видел ли кто-нибудь, кроме меня, как у меня всё настроено.

Отвечать на этот вопрос труднее всего, и трудность здесь не техническая. Впустить кого-то в свою работу почти невозможно. Всё, что там устроено, устроено мной, каждое решение принималось в конкретных обстоятельствах, часто наспех, и любое замечание со стороны звучит не как замечание к настройке, а как замечание ко мне. Даже доброжелательный вопрос «а почему здесь так» я слышу как «здесь плохо», а иногда и как посягательство на то, что я строила месяцами. Сделанное своими руками защищаешь как собственное пространство, почти как крепость, и тем сильнее, чем больше в него вложено.

Отчёт показывает, что этот страх не выдуманный. Anthropic — единственная из пяти, кто пустил проверяющих внутрь по-настоящему глубоко, и именно поэтому у неё нашли уязвимости, а её отчёт выглядит небезупречно. Открывшись, она стала выглядеть хуже. У xAI по этой строке ноль, но это ноль не чистоты, а закрытости: смотреть было нечего. Отсутствие плохих новостей — не хорошая новость, а отсутствие данных.

Получается, что цена за возможность узнать о себе правду — выглядеть хуже тех, кто не показал ничего. И заплатить её всё равно приходится, потому что другого способа получить эти сведения нет: изнутри крепости не видно, где в ней дыра.

Шестое — что я делаю в первые десять минут

Последняя практика — план на случай, когда всё предыдущее не сработало. Какие доступы отозвать немедленно, какие ключи отключить, кого и в какой срок предупредить, сколько времени занимает полное выключение и проверялось ли это на практике.

Тот же вопрос себе. Есть ли у меня такой план вообще.

Чтобы понять, чего именно мне не хватает, я стала искать, где такой план у меня всё-таки есть. В обычной жизни он есть, просто я не называю это планом. Самый понятный пример — банковская карта. Если с неё пропадут деньги, я знаю, где взять номер, знаю, что звоню и блокирую, и сделаю это почти автоматически, не выстраивая последовательность заново. Похожее устроено у каждого и в других вещах: паспорт и важные документы лежат в одном определённом месте, и в плохую минуту не приходится вспоминать, в каком именно.

Здесь у меня нет ничего похожего. Разбираясь почему, я нашла две дыры, и обе лежат раньше самого плана.

Первая: у меня нет представления, что именно может пойти не так. С картой сценарий известен и он один. Здесь я не могу перечислить даже пяти правдоподобных сценариев, а значит и готовиться мне не к чему — план предполагает, что известно, от чего он.

Вторая хуже. Допустим, я решила остановить всё. Что такое здесь «всё»? С картой это одна карта и один номер. Здесь — неизвестное количество доступов, ключей, подключённых сервисов и агентов, работающих под капотом, часть из которых я подключила месяцы назад и с тех пор не вспоминала. Прежде чем появится план остановки, должен появиться список того, что останавливается. Его у меня нет, и собрать его задним числом — отдельная работа, до которой я так и не дошла.

Это самая слабая строка во всей отрасли, средний балл 1,2 из 5. И здесь же самая интересная деталь всего документа.

Anthropic — компания, построившая публичную идентичность на безопасности, — получила по этому пункту ноль. Когда её спросили, она ответила, что при обнаружении попыток обхода провела бы оценку рисков, и Guidelight записала: это описание реакции, а не протокол локализации.

Я не читаю это как разоблачение, среди пятерых Anthropic в верхней части таблицы. Я читаю это как о
  • 🔥 1
More from @mejdu_ai
  1. Sep 29, 2026Channel name was changed to «Между · человек и ИИ»
  2. Sep 29, 2026Что проходит проверку. Часть 3: человеческие слова В записях из отчёта OpenAI агенты пишут…
  3. Sep 29, 2026Что проходит проверку. Часть 2: «не будем» В отчёте OpenAI есть запись агента, который уви…
  4. Sep 29, 2026Что проходит проверку. Часть 1: ответ найден В конце августа OpenAI опубликовала отчёт об…
  5. Sep 26, 2026Команда из одного человека. Часть 3 Словом «разделить» обычно называют две разные вещи. В…
  6. Sep 26, 2026Команда из одного человека. Часть 2 За пределами того, что берут на себя агенты, остаётся…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →