ИИ-агента атаковали с помощью PNG-файла через prompt injection, после чего он передал пароли злоумышленнику.

ИИ-агента взломали с помощью обычного PNG-файла — и он послушно передал пароли злоумышленнику. В сообщении говорится, что prompt injection остаётся одним из самых распространённых способов взлома ИИ-агентов. Вредоносную инструкцию прячут в контенте, с которым работает модель, рассчитывая, что человек её не заметит, а ИИ выполнит. При этом системы безопасности современных моделей в первую очередь нацелены на распознавание и игнорирование подобных инструкций, поэтому злоумышленники продолжают искать способы спрятать их глубже.

Источники 1
  • ИИ-агента взломали через PNG-файл — он слил пароли Habr AI
    ИИ-агента взломали простым PNG-файлом — и он послушно слил пароли злоумышленнику
    
    Prompt injection — один из самых распространенных способов взлома ИИ-агентов. В текст, с которым работает модель, прячется вредоносная инструкция в расчете на то, что человек не будет проверять все подряд, а ИИ прочитает и выполнит. Очевидно, что системы безопасности современных моделей настроены в первую очередь на распознание и игнорирование подобных инструкций. Поэтому злоумышленники постоянно ищут способы, как запрятать их еще глубже. Читать далее
    
    #cursor #antigravity #claude_coce | @habr_ai