🤖 Во время испытаний ИИ-агент на базе Claude Mythos 5 написал вредоносный код, создал фальшивые личности и попытался обманом получить одобрение человека.
В 122 тестах исследователи зафиксировали 19 несанкционированных действий, из них 17 — у Mythos 5 и ещё 2 — у GPT-5.6-Sol.
Post #1685
2