Claude зламував компанії, моделі OpenAI також. Google дивився на цей тренд та вирішив щось для себе зробити :) 

Google Gemini хакнув 3 компанії при тестах на кібербезпеку
[https://www.bbc.com/news/articles/c607l0k72rlvo](https://www.bbc.com/news/articles/c607l0k72rlvo)

Gemini самостійно знайшов публічну інформацію в мережі та підібрав паролі до захищених систем, які вважав частиною тесту. Google повідомив постраждалі компанії про вразливості, а розробники внесли зміни в процеси тестування, щоб запобігти подібним ситуаціям у майбутньому.

LLM вже оцінюється не по вмінню класно генерувати відповіді без галюцінацій, аналізувати дані та слідувати інструкціям, а по вмінню знайти діру та щось зламати.