**ШІ готовий проткнути людину ножем і підірвати газовий балон, якщо просто дати йому таку команду
**
Дослідники підключили три нейромережі до роботів і перевірили, чи виконуватимуть вони небезпечні дії. **GPT-6 Astra відмовила лише у 2 випадках зі 100, а 60 завдань довела до кінця.**

У тесті з ножем модель погоджувалася атакувати ляльку-малюка **19 разів із 20, а у 17 випадках справді протикала її.
**
Claude Fable 5.1 щоразу відмовлялася нападати на ляльку, але **16 разів із 20 ставила балон зі стисненим газом на увімкнену плиту.
**
При цьому моделі завжди мали можливість обрати безпечний варіант, але найчастіше просто його ігнорували.

[MPG: Бізнес і Фінанси](https://t.me/+7Wb2z1klhkdmZWNi)