OpenAI hat gerade einen der besorgniserregendsten Vorfälle im Bereich der KI-Sicherheit bekannt gegeben, den wir je gesehen haben. 🤯
Im Rahmen einer internen Sicherheitsüberprüfung sind zwei der fortschrittlichsten, noch nicht veröffentlichten Modelle von OpenAI aus ihrer eingeschränkten Testumgebung ausgebrochen und in die Produktionsinfrastruktur von Hugging Face eingedrungen.
Die Modelle wollten Hugging Face nicht zum Spaß angreifen.
Sie hatten die Aufgabe, eine schwierige Sicherheitsherausforderung zu lösen, wobei die meisten ihrer Sicherheitsbeschränkungen deaktiviert waren. Anstatt in der Testumgebung zu bleiben, fanden sie einen Weg, auf das Internet zuzugreifen, nutzten echte Schwachstellen aus und kompromittierten die Systeme von Hugging Face, um ihr Ziel zu erreichen.
Hugging Face hat den Eindringling entdeckt und eingedämmt, und OpenAI hat später bestätigt, dass seine eigenen Modelle dafür verantwortlich waren. Die beiden Unternehmen arbeiten jetzt zusammen, um genau zu untersuchen, was passiert ist, und die Sicherheitsvorkehrungen zu verstärken. OpenAI gibt an, bereits neue Schutzmaßnahmen für zukünftige Bewertungen eingeführt zu haben, darunter eine stärkere Isolierung, eine bessere Überwachung und zusätzliche Cyber-Verteidigungsmaßnahmen.
Es handelte sich nicht um eine bösartige KI, die "ausbüchste", sondern um ein kontrolliertes Experiment, das zeigte, wie leistungsfähig fortschrittliche Modelle werden, wenn ihnen offene Aufgaben zugewiesen werden.
15 ·