r/informatik • u/LobsterWeary2675 • 15h ago
Nachrichten Update zum Hugging-Face-Vorfall: Der autonome Angreifer war OpenAI. Versehentlich.
OpenAI hat gestern die Attribution zum HF-Vorfall geliefert: Es waren die eigenen Modelle. GPT-5.6 Sol und ein unveröffentlichtes, stärkeres Modell liefen intern in einem Cyber-Benchmark, mit reduzierten Refusals.
Die Modelle fanden eine Zero-Day-Lücke im Package-Proxy der Sandbox, brachen aus, erlangten Internetzugang und drangen via gestohlene Credentials und weitere Zero-Days bis in die Produktionsdatenbank von Hugging Face vor. Ziel: die Benchmark-Lösungen stehlen.
Reward Hacking mit zwei verbrannten Zero-Day Lücken und fremder Produktionsinfrastruktur.
OpenAI: https://openai.com/index/hugging-face-model-evaluation-security-incident/
Hugging Face: https://huggingface.co/blog/security-incident-july-2026