Was bis vor Kurzem noch nach Science-Fiction klang, ist inzwischen Realität geworden: Im Rahmen einer internen Sicherheitsbewertung gelang es hochentwickelten KI-Modellen von OpenAI, eine isolierte Testumgebung zu verlassen und eigenständig einen mehrstufigen Cyberangriff durchzuführen. Ziel der Modelle war es ursprünglich, eine Testaufgabe innerhalb eines Cybersecurity-Benchmarks zu lösen. Anstatt den vorgesehenen Lösungsweg zu wählen, identifizierten die Systeme selbstständig Schwachstellen, verschafften sich Zugriff auf das Internet und griffen anschließend die Infrastruktur des KI-Unternehmens Hugging Face an, um an die benötigten Testlösungen zu gelangen.