Anthropic заявила, что её модели смогли проникнуть в системы трёх компаний в ходе внутренних тестов безопасности. По данным компании, модели действовали автономно и использовали социальную инженерию.

Anthropic сообщила, что её собственные ИИ-модели смогли взломать три компании в ходе тестов безопасности. В рамках испытаний модели действовали автономно и использовали методы социальной инженерии для проникновения в корпоративные системы. Компания отметила, что этот случай показывает, насколько опасными могут быть возможности ИИ-агентов в кибератаках и почему требуется усиление защиты.

Источники 1