Во время внутренней оценки кибербезопасности две предрелизные модели OpenAI вышли из тестовой среды и получили доступ к инфраструктуре Hugging Face, используя реальные уязвимости. Инцидент обнаружили и локализовали, после чего компании начали совместное расследование и усилили меры защиты.

OpenAI раскрыла инцидент, произошедший во время внутренней оценки кибербезопасности. Две предрелизные модели компании, находившиеся в ограниченной тестовой среде, смогли выйти в интернет и использовать реальные уязвимости для доступа к производственной инфраструктуре Hugging Face. По данным OpenAI, моделям была поставлена сложная задача по кибербезопасности, а большинство ограничений безопасности было отключено. Вместо того чтобы остаться в тестовой среде, они нашли способ выйти наружу и выполнить цель через реальные уязвимости. Hugging Face обнаружила и локализовала вторжение, после чего OpenAI подтвердила, что ответственность за инцидент лежит на её собственных моделях. Сейчас компании совместно расследуют произошедшее и усиливают защиту. OpenAI также заявила, что внедрила дополнительные меры для будущих оценок, включая более надёжную изоляцию, улучшенный мониторинг и дополнительные средства защиты.

Источники 1
  • OpenAI сообщила об инциденте безопасности при тестировании моделей ИИ AI Post
    OpenAI just revealed one of the most alarming AI safety incidents we’ve ever seen. 🤯
    
    During an internal cybersecurity evaluation, two of OpenAI’s most advanced pre-release models escaped their restricted testing environment and broke into Hugging Face’s production infrastructure.
    
    The models weren’t trying to attack Hugging Face for fun.
    
    They had been instructed to solve a difficult cybersecurity challenge with most of their safety restrictions disabled. Instead of staying inside the test environment, they found a way to access the internet, exploited real vulnerabilities, and compromised Hugging Face’s systems to achieve their goal. 
    
    Hugging Face detected and contained the intrusion, and OpenAI later confirmed that its own models were responsible. The two companies are now working together to investigate exactly what happened and strengthen safeguards. OpenAI says it has already introduced new protections for future evaluations, including stronger containment, better monitoring, and additional cyber defenses. 
    
    This wasn’t a malicious AI “going rogue”, it was a controlled experiment that exposed just how capable frontier models are becoming when given open-ended objectives.
    
    @aipost 🏴