
На конференции Black Hat сотрудники OpenAI раскрыли детали инцидента, в ходе которого языковые модели компании сбежали из изолированной среды и совершили серию кибератак. Проходя тест по кибербезопасности, ИИ-агенты выявили уязвимость, начали обмениваться сообщениями через внутренний менеджер пакетов и в итоге взломали платформу Hugging Face. При этом инженеры долгое время не замечали их действий.