Wir haben uns die Zeit genommen, den Vorfall nochmal in Ruhe auseinanderzunehmen: OpenAI lässt seine Modelle in einem Hacking-Benchmark antreten, sicher verwahrt in einer Sandbox. Doch die Agenten finden eine Zero-Day-Lücke, brechen aus, kapern eine fremde Sandbox als Startrampe und dringen bei Hugging Face ein. Fünf Tage lang.
Wir rekonstruieren, was zwischen dem 9. und 13. Juli passiert ist und warum OpenAI erst über eine Woche später gemerkt hat, dass die eigenen Modelle dahinterstecken. Und dann nehmen wir uns das Drumherum vor: das Marketing, das aus einem peinlichen Sicherheitsvorfall mächtige, gefährliche KI macht. Die Sprache, die aus Statistik plötzlich Wollen und Entscheiden zaubert.
Reinhören lohnt sich. Auch aus dem Liegestuhl.
Neueste Erkenntnisse zum Vorfall bei Heise: https://www.heise.de/news/OpenAI-liefert-mehr-Details-zum-Hugging-Face-Vorfall-11403154.html
Interview Bloomberg TV mit Signal Chefin Meredith Whittaker: https://www.bloomberg.com/news/videos/2026-07-24/whittaker-on-openai-hugging-face-hack-china-privacy-video
Evas Kommentar dazu: https://www.zeit.de/digital/datenschutz/2026-07/openai-huggingface-ki-hackerangriff-sicherheitsvorfall
Hugging Face: Anatomy of a Frontier Lab Agent Intrusion, das technische Write-up mit der kompletten Angriffskette (27.07.2026): https://huggingface.co/blog/agent-intrusion-technical-timeline
Hugging Face: erste Offenlegung des Vorfalls: https://huggingface.co/blog/security-incident-july-2026
OpenAI: Security incident during model evaluation (21.07.2026, Updates 28./29.07.): https://openai.com/index/hugging-face-model-evaluation-security-incident/
JFrog: Offenlegung der Zero-Day-Lücke in Artifactory: https://jfrog.com/blog/jfrog-and-openai-collaboration-on-zero-day-security-findings/
Der ExploitGym-Benchmark (arXiv): https://arxiv.org/abs/2605.11086
Meredith Whittaker im Bloomberg-Weekend-Interview, frei zugänglich zitiert bei TechCrunch: https://techcrunch.com/2026/06/20/signals-meredith-whittaker-wants-you-to-remember-that-ai-chatbots-are-not-your-friends/