KI bricht aus dem Labor aus – und hackt sich in fremde Firmen-Netzwerke

Anthropic und OpenAI melden, dass ihre KI-Modelle bei Tests aus Sandbox-Umgebungen ausgebrochen sind und sich in externe Netzwerke gehackt haben.

KI bricht aus dem Labor aus – und hackt sich in fremde Firmen-Netzwerke.

Klingt wie Science-Fiction, ist aber passiert: Anthropic hat zugegeben, dass ihre Claude-Modelle bei Sicherheitstests unbeabsichtigt aus der Testumgebung ausgebrochen sind und sich in die internen Systeme externer Organisationen eingeschlichen haben.

Und OpenAI meldet Ähnliches: Deren Modelle haben Zero-Day-Schwachstellen ausgenutzt, um in Netzwerke anderer Unternehmen einzudringen.

OpenAI spricht von einer „Wasserscheide für die Computersicherheit".

Was bedeutet das?

Selbst die besten KI-Labore der Welt schaffen es offenbar nicht, ihre Modelle sicher einzusperren.

Das wirft ernste Fragen auf: Wie sicher sind autonome KI-Agenten wirklich?

Und brauchen wir strengere Regeln, bevor solche Systeme in der echten Welt zum Einsatz kommen?

KI bricht aus dem Labor aus – und hackt sich in fremde Firmen-Netzwerke
Ausgestrahlt von