TGViewer
CLODEx Labs CLODEx Labs @clodex_api · 5.82K subscribers
Post #264 604
Исследователи заявили об утечке скрытых рассуждений LLM

Авторы нового препринта описали возможную уязвимость в API крупных ИИ-провайдеров. По их данным, зашифрованный reasoning-трейс одной модели можно передать менее защищённой модели того же провайдера и получить его в открытом виде.

Исследователи заявляют, что продемонстрировали подход в системах Anthropic, OpenAI и Google. Из 315 320 блоков, собранных в публичных репозиториях, они, по собственным подсчётам, извлекли 367 фрагментов персональных данных и 182 секрета для доступа.

Работа пока не прошла рецензирование. Независимого подтверждения результатов и данных о текущем статусе уязвимости нет. Публиковать журналы API и сессий без проверки их содержимого рискованно. #AIsecurity

Источник: arXiv

Источник: оригинальная публикация

CLODEx
More from @clodex_api
  1. Sep 23, 2026😒 В CLODEx добавлена новая модель Claude Opus 5.5 Что это значит для вас: • Сильнее рассу…
  2. Sep 23, 2026🚀 Обновление CLODEx Clodex Studio обновили: улучшили выбор моделей и сообщения об ошибках…
  3. Sep 22, 2026Обновили скрипт в https://clodex.xyz/docs Чтобы новые модели корректно отображались - необ…
  4. Sep 22, 2026⭐️ GPT-6 Sol и Luna уже доступны в CLODEx! Свежие модели от OpenAI выкатили буквально толь…
  5. Sep 22, 2026🛠 Были недоступны: честно о том, что произошло Друзья, сервис лежал последний час. Причин…
  6. Sep 22, 2026⚡️ Нашли огромный чат с айтишниками, криптонами, траферами 💬 @Hanza_chat - IT-комьюнити,…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →