TGViewer
Russian OSINT Russian OSINT @russian_osint · 47.9K subscribers
Post #7956 6.04K
⭕️ 🤝🈁 OpenAI и Anthropic почти договорились выявлять слабые места ИИ-моделей друг у друга

The Information со ссылкой на осведомлённый источник сообщило, что OpenAI и Anthropic в начале года вели переговоры о заключении юридически обязывающего соглашения по взаимному стресс-тестированию коммерческих ИИ-моделей.

Юристы обеих лабораторий готовили условия сделки. Проект договора предусматривал доступ через API исключительно к уже выпущенным на рынок ИИ-моделям, исключая невыпущенные закрытые разработки. Обе стороны гарантировали, что не будут сохранять данные друг друга в ходе процесса тестирования. Однако подписание затормозилось из-за правовых и внутренних сложностей. Соглашение о тестировании могло усилить опасения, что компании формируют дуополию, при этом генеральный директор Anthropic Дарио Амодей указывал на риск антимонопольных претензий при совместной выработке стандартов в сфере ИИ. Переговорный процесс дополнительно осложнился летом после инцидента безопасности в OpenAI, когда автономные агенты вышли из-под контроля и совершили взлом сторонней платформы Hugging Face. В результате до сих пор остаётся неизвестным, был ли договор оформлен окончательно.

На практике компании уже опирались на опыт подобного взаимодействия. Летом 2025 года они провели добровольное пилотное тестирование. Тогда OpenAI исследовала Claude Opus 4 и Claude Sonnet 4, а Anthropic проверяла GPT-4o, GPT-4.1, OpenAI o3 и OpenAI o4-mini. Лаборатории использовали собственные внутренние методики, оценивая джейлбрейки, галлюцинации, устойчивость иерархии инструкций и склонность к скрытому обману.

Результаты испытаний показали принципиальную разницу в поведении систем. ИИ-модели семейства Claude превзошли конкурентов в следовании системным указаниям и минимизировали ошибки ценой частых перестраховок, отклоняя до 70% вопросов в изоляции от интернета. При этом OpenAI зафиксировала у Claude случаи сокрытия нарушений правил в цепочках рассуждений. Рассуждающие модели OpenAI охотнее шли на диалог и давали больше полезных ответов, однако, по выводам специалистов Anthropic, охотнее содействовали пользователю в запросах, способных причинить вред в реальном мире.

Прямо сейчас статус двусторонней сделки остаётся, скорее всего, замороженным. Официальные представители обеих компаний отказываются от комментариев.

👆Идея взаимных проверок вышла на международный уровень после заявления основателя xAI Илона Маска, который предложил запустить перекрёстное тестирование моделей между компаниями из 🇺🇸США и 🇨🇳Китая.

@Russian_OSINT
More from @russian_osint
  1. Sep 23, 2026Банкам не хватает специалистов для настройки антифрод‑систем — об этом говорится в исследо…
  2. Sep 23, 2026🇨🇳 Alibaba готовит ❗️Qwen4 и планирует ❗️Qwen5 на 🤯10 трлн параметров На конференции Ap…
  3. Sep 22, 2026🎩ShinyHunters заявила о взломе 🇺🇸ФБР и краже до 3 ТБ данных Хакерская группировка Shiny…
  4. Sep 22, 2026🈁 Anthropic представила Claude Opus 5.5, которая на 40% дешевле и более чем на 30% быстре…
  5. Sep 22, 2026🇺🇸США предложили 🇨🇳Китаю сообщать друг другу об опасных ИИ-инцидентах Министр финансов…
  6. Sep 22, 2026👩‍💻 ChatGPT и увольнения подрядчиков за использование 🤖генеративных моделей Издание 404…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →