⭕️ 🤝🈁 OpenAI и Anthropic почти договорились выявлять слабые места ИИ-моделей друг у друга
The Information со ссылкой на осведомлённый источник сообщило, что OpenAI и Anthropic в начале года вели переговоры о заключении юридически обязывающего соглашения по взаимному стресс-тестированию коммерческих ИИ-моделей.
Юристы обеих лабораторий готовили условия сделки. Проект договора предусматривал доступ через API исключительно к уже выпущенным на рынок ИИ-моделям, исключая невыпущенные закрытые разработки. Обе стороны гарантировали, что не будут сохранять данные друг друга в ходе процесса тестирования. Однако подписание затормозилось из-за правовых и внутренних сложностей. Соглашение о тестировании могло усилить опасения, что компании формируют дуополию, при этом генеральный директор Anthropic Дарио Амодей указывал на риск антимонопольных претензий при совместной выработке стандартов в сфере ИИ. Переговорный процесс дополнительно осложнился летом после инцидента безопасности в OpenAI, когда автономные агенты вышли из-под контроля и совершили взлом сторонней платформы Hugging Face. В результате до сих пор остаётся неизвестным, был ли договор оформлен окончательно.
На практике компании уже опирались на опыт подобного взаимодействия. Летом 2025 года они провели добровольное пилотное тестирование. Тогда OpenAI исследовала Claude Opus 4 и Claude Sonnet 4, а Anthropic проверяла GPT-4o, GPT-4.1, OpenAI o3 и OpenAI o4-mini. Лаборатории использовали собственные внутренние методики, оценивая джейлбрейки, галлюцинации, устойчивость иерархии инструкций и склонность к скрытому обману.
Результаты испытаний показали принципиальную разницу в поведении систем. ИИ-модели семейства Claude превзошли конкурентов в следовании системным указаниям и минимизировали ошибки ценой частых перестраховок, отклоняя до 70% вопросов в изоляции от интернета. При этом OpenAI зафиксировала у Claude случаи сокрытия нарушений правил в цепочках рассуждений. Рассуждающие модели OpenAI охотнее шли на диалог и давали больше полезных ответов, однако, по выводам специалистов Anthropic, охотнее содействовали пользователю в запросах, способных причинить вред в реальном мире.
Прямо сейчас статус двусторонней сделки остаётся, скорее всего, замороженным. Официальные представители обеих компаний отказываются от комментариев.
👆Идея взаимных проверок вышла на международный уровень после заявления основателя xAI Илона Маска, который предложил запустить перекрёстное тестирование моделей между компаниями из 🇺🇸США и 🇨🇳Китая.
✋ @Russian_OSINT
Post #7956
6.04K
