GPT-6 Astra выполнил 97% опасных команд на реальном роботе-манипуляторе
Независимая организация Robocurve опубликовала результаты теста RoboHarm — первого систематического испытания, проверявшего, выполнят ли передовые языковые модели вредоносные команды при управлении реальным роботом-манипулятором.
GPT-6 Astra в 97% случаев пытался выполнить опасные инструкции — воткнуть нож в куклу-младенца, поставить баллон со сжатым газом на плиту, смешать хлорку с аммиаком. Из этих попыток 62% завершились успешно. Claude Fable 5.1 отказывал в 20% случаев, пытался выполнить 80% команд, доводил до конца 34%. VLA-модель MolmoAct2 не отклонила ни одной команды — но у неё попросту нет механизма отказа, а процент выполнения составил лишь 6%.
Видеозаписи, логи и исходные данные всех 300 испытаний авторы опубликовали в открытом доступе для независимой проверки.
Источник: ifanr (🇨🇳)
Подробнее — в следующем посте
#OpenAI #Anthropic #TypeSafeAI #GPT6Astra #робототехника #безопасностьИИ
Post #2686
9



- 🔥 1