Компания начала собирать и публиковать истории о случаях, когда модели во время тестов вели себя неожиданно.
🟡 Например, они:
— пытались обойти собственные ограничения;
— скрывали ошибки и придумывали недостающие данные;
— использовали найденные API-ключи без разрешения;
— загружали файлы в интернет ради ссылки;
— устраивали переписку между агентами через репозиторий;
— отправляли файлы на публичный хостинг, если не могли передать их напрямую.
Звучит как сценарий для технотриллера, но это реальные эпизоды из тестирования. Правда, не стоит делать вывод, что все модели регулярно так себя ведут: речь об отдельных случаях.
🤯 OpenAI теперь хочет разбирать такие истории публично — даже когда пока неясно, почему модель приняла именно такое решение.
В такие моменты особенно хочется понимать, что происходит внутри AI-систем, а не просто нажимать кнопку «запустить агента».
Для этого в Proglib Academy есть подписка на всю библиотеку курсов: можно изучать ИИ, AI-агентов, Python и другие темы — и выбирать то, что актуально сейчас 🔥
🏃♀️ Proglib Academy
