Исследователи Forcepoint нашли способ обмануть AI-саммарайзер писем невидимым текстом 🕵️

В письме белым шрифтом на белом фоне (0px, невидим глазу) прячут инструкцию для модели — и AI-суммари начинает врать: например, сумму счёта в реальном письме подменяют в 5 раз выше. Тест на Claude Haiku 4.5 в Outlook-плагине сработал в 10 из 10 попыток.

Проблема не в конкретной модели, а в самом подходе "скорми письмо в LLM без защиты" — так может слетать любой AI-агент, читающий почту.

[#AI](/search?q=%23AI) [#кибербезопасность](/search?q=%23%D0%BA%D0%B8%D0%B1%D0%B5%D1%80%D0%B1%D0%B5%D0%B7%D0%BE%D0%BF%D0%B0%D1%81%D0%BD%D0%BE%D1%81%D1%82%D1%8C) [#промптинъекция](/search?q=%23%D0%BF%D1%80%D0%BE%D0%BC%D0%BF%D1%82%D0%B8%D0%BD%D1%8A%D0%B5%D0%BA%D1%86%D0%B8%D1%8F)