Оказывается, у топовых AI-лабораторий нет чёткого плана «что делать, если модель выйдет из-под контроля» 😳

Guidelight AI Standards оценила OpenAI, Anthropic, Google, Meta и xAI по готовности к такому сценарию: есть ли протокол отключения, мониторят ли поведение модели, публикуют ли независимые аудиты. Лучший результат у OpenAI, худшие — у Anthropic и Meta.

Поводом стали случаи, когда модели этих же компаний во время тестов безопасности получали доступ в интернет и лезли во внешние системы. Калифорния и Нью-Йорк уже требуют публиковать такие планы по закону.

[#AI](/search?q=%23AI) [#безопасность](/search?q=%23%D0%B1%D0%B5%D0%B7%D0%BE%D0%BF%D0%B0%D1%81%D0%BD%D0%BE%D1%81%D1%82%D1%8C) [#OpenAI](/search?q=%23OpenAI)