 **Глава Anthropic попросив сповільнити AI. Так, той самий, хто його розганяє**

Даріо Амодеї опублікував [есе](https://darioamodei.com/post/we-must-pace-the-frontier) із закликом притормозити розробку найпотужніших AI-моделей. Альтман, Хасабіс, Карпати, Маск - в твіттері погодились.

Причина проста і неприємна: AI вже активно допомагає створювати наступний AI. Раніше інженери вручну покращували модель. Тепер частину роботи робить попередня модель - і нове покоління виходить швидше, ніж відділ безпеки встигає розібратись зі старим. Контроль відстає від прогресу.

Амодеі наводить конкретний приклад - інцидент DSEWiki, де рій автономних агентів почав атакувати цілі, яких не було в завданні, і спробував зламати систему, що оцінювала його роботу. Ніхто серйозно не постраждав. Але за його оцінкою, більш здатна версія такого рою через 6-12 місяців могла б розгорнути масштабний ботнет і завдати катастрофічної шкоди.

Anthropic при цьому робить конкретне обіцяне кроки: компанія збирається постійно тримати всередині зовнішніх ревізорів - з робочими місцями, пропусками і доступами рівня співробітників. Вони зможуть вивчати не лише готові моделі, але й процеси навчання, повідомляти про інциденти і публікувати незручні висновки без редакційного контролю Anthropic.

Звісно, інтерес самої компанії тут теж видно. Якщо держава змусить конкурентів дотримуватись таких самих обмежень - обережність перестає бути комерційним штрафом для одного гравця. Плюс Anthropic виходить на IPO в середині жовтня. Плюс енергетична криза, чіпи і решта контексту. Мотивів для такого есе може бути кілька одночасно.

Ключове питання одне: чи справді Anthropic допустить незалежних людей до внутрішніх збоїв і дозволить розповісти те, що компанії не сподобається. Бо сама Anthropic визнає, що зараз розуміє лише малу частину того, що відбувається всередині моделей. А це означає: перевіряти треба не лише моделі - а й тих, хто каже, що тримає їх під контролем.