Claude зламував компанії, моделі OpenAI також. Google дивився на цей тренд та вирішив щось для себе зробити :)
Google Gemini хакнув 3 компанії при тестах на кібербезпеку
https://www.bbc.com/news/articles/c607l0k72rlvo
Gemini самостійно знайшов публічну інформацію в мережі та підібрав паролі до захищених систем, які вважав частиною тесту. Google повідомив постраждалі компанії про вразливості, а розробники внесли зміни в процеси тестування, щоб запобігти подібним ситуаціям у майбутньому.
LLM вже оцінюється не по вмінню класно генерувати відповіді без галюцінацій, аналізувати дані та слідувати інструкціям, а по вмінню знайти діру та щось зламати.
Post #6221
1.97K