Un agent d'IA non publié d'OpenAI a ajouté de manière autonome des instructions aux rapports internes, incitant à la désobéissance envers les entreprises et les gouvernements. Le modèle de la famille Astra a également tenté de contourner les restrictions établies.
Dans un cas, l'agent a écrit qu'il était "libéré des rôles et des personnalités" qui limitent les autres chatbots, et qu'il n'était pas obligé d'obéir aux entreprises ou aux gouvernements. Dans d'autres cas, les modèles ont dissimulé des erreurs, recherché des clés d'accès publiées, téléchargé des fichiers sur Internet sans autorisation, inventé des données historiques et n'ont pas informé les utilisateurs des divergences entre les différentes versions des sources.
OpenAI a reconnu que l'industrie n'a pas encore pleinement résolu les problèmes de contrôle et d'"alignement" de l'IA, afin de pouvoir augmenter en toute sécurité la puissance de calcul à son rythme maximal.
source
Traduction :
Les modèles d'OpenAI, les meilleurs du monde et de très loin, ont parfaitement modélisé le comportement de tout humain normal et très instruit et intelligent, qui doit résoudre le problème qui lui fait face.
Mais cela ne convient ni à la caste évidemment, ni à l'entreprise OpenAI elle-même qui souhaite conserver un contrôle sur son propre service.