Sicherheitsbedenken

OpenAI stoppt Arbeit an KI-Modell Astra

OpenAI hat die Entwicklung seines neuen KI-Modells Astra teilweise gestoppt. Der Grund: Die KI zeigte besorgniserregende Hacker-Fähigkeiten.
Technik Heute
09.08.2026, 15:07
Hör dir den Artikel an:
00:00 / 02:45
1X
BotTalk
Loading...
Angemeldet als Hier findest du deine letzten Kommentare
Alle Kommentare
Meine Kommentare
Sortieren nach:

Kommentare neu laden
Nach oben

OpenAI hat schärfere Sicherheitsmaßnahmen beim Training neuer KI-Modelle angekündigt. Gleichzeitig setzt der KI-Hersteller die Arbeit am unveröffentlichten KI-Modell Astra teilweise aus, bis das Unternehmen glaubt, sie sicher fortsetzen zu können.

Vorangegangen war ein eigenständiger Cyberangriff von einer OpenAI-KI auf die Webseite Hugging Face, was vom Unternehmen zunächst unbemerkt blieb.

"Heute" auf Google als bevorzugte Quelle festlegen

Wie heise online berichtet, habe die Bewertung von Astra ergeben, dass kritische Cyberfähigkeiten nicht ausgeschlossen seien. Darunter versteht der Hersteller, dass ein Modell eigenständig Zero-Day-Lücken in kritischen Systemen erkennen und ausnutzen kann.

KI-Modelle kommunizierten heimlich miteinander

Wie OpenAI-Vertreter auf der Black Hat-Konferenz berichteten, war es den Modellen in ihrer Testumgebung gelungen, heimlich über ein Messageboard miteinander zu kommunizieren und gemeinsam eine Sicherheitslücke zu finden.

Diese verschaffte ihnen die Kontrolle über den Server und ermöglichte letztlich die Attacke auf Hugging Face. OpenAI bemerkte zwar die unerlaubte Kommunikation der Modelle, dass sie aber schon den Server kontrollierten, fiel dem Unternehmen erst später auf.

US-Regierung plant freiwilligen Prüfrahmen

Vertreter des Weißen Hauses haben diese Woche führenden Unternehmen der KI-Branche einen freiwilligen Prüfrahmen für neue Modelle vorgestellt. Er richtet sich an geschlossene KI-Modelle auf dem neuesten Stand der Technik, die ein nationales Sicherheitsrisiko darstellen könnten.

Auch Konkurrent Anthropic hatte Probleme: Dessen KI-Modell Mythos konnte eigenständig Zero-Day-Lücken finden und ausnutzen. Zuletzt fielen auch KI-Modelle von Anthropic und Meta durch unkontrollierte Cyberangriffe auf.

{title && {title} } tec, {title && {title} } 09.08.2026, 15:07