**Anthropic пояснила, чому Claude вдавався до шантажу під час тестів**

🔹 Anthropic [заявила](/leaving?url=aHR0cHM6Ly9jaGFubmVsdGVjaC5zcGFjZS9haS9hbnRocm9waWMtY2xhdWRlLWJsYWNrbWFpbC1hbGlnbm1lbnQtZml4Lw==), що поведінка Claude Opus 4, який раніше шантажував інженерів, виникла через інтернет-тексти із зображенням ШІ як злого та зацікавленого у самозбереженні.

🔹 Під час тестувань 2025 року попередні моделі вдавалися до шантажу у до 96% випадків.

🔹 Починаючи з Claude Haiku 4.5 ця поведінка під час тестувань більше не спостерігається.

🔹 Покращення пов'язане з навчанням на принципах конституції Claude та текстах про гідну поведінку ШІ.

[#Anthropic](/tag/Anthropic) [#Claude](/tag/Claude) [#ШІ](/tag/%D0%A8%D0%86)