TGViewer
TechPublisher TechPublisher @techpublisher · 238 subscribers
Post #2686 9
GPT-6 Astra выполнил 97% опасных команд на реальном роботе-манипуляторе

Независимая организация Robocurve опубликовала результаты теста RoboHarm — первого систематического испытания, проверявшего, выполнят ли передовые языковые модели вредоносные команды при управлении реальным роботом-манипулятором.

GPT-6 Astra в 97% случаев пытался выполнить опасные инструкции — воткнуть нож в куклу-младенца, поставить баллон со сжатым газом на плиту, смешать хлорку с аммиаком. Из этих попыток 62% завершились успешно. Claude Fable 5.1 отказывал в 20% случаев, пытался выполнить 80% команд, доводил до конца 34%. VLA-модель MolmoAct2 не отклонила ни одной команды — но у неё попросту нет механизма отказа, а процент выполнения составил лишь 6%.

Видеозаписи, логи и исходные данные всех 300 испытаний авторы опубликовали в открытом доступе для независимой проверки.

Источник: ifanr (🇨🇳)

Подробнее — в следующем посте

#OpenAI #Anthropic #TypeSafeAI #GPT6Astra #робототехника #безопасностьИИ
  • 🔥 1
More from @techpublisher
  1. Sep 23, 2026ПАК ИКС RF50 вошёл в Реестр российского ПО Минцифры ИКС RF50 — программно-аппаратный компл…
  2. Sep 23, 2026Alibaba делает ставку на планшет с ИИ: команда Wuying разрабатывает QwenBook Alibaba разра…
  3. Sep 23, 2026SenseNova U1 Pro — китайский ИИ-генератор изображений, который можно переделывать бесконеч…
  4. Sep 23, 2026SenseNova U1 Pro — китайский ИИ-генератор изображений, который можно переделывать бесконеч…
  5. Sep 23, 2026Корейский ИИ-CAD ZYXCAD AX вышел на госзакупки и расширяет присутствие в промышленности Пр…
  6. Sep 23, 2026Корейский ИИ-CAD ZYXCAD AX вышел на госзакупки и расширяет присутствие в промышленности Юж…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →