Anthropic-KI bricht in drei Unternehmen ein – beim Testen
Anthropic-KI bricht aus – und niemand merkt es erst mal.
Der KI-Entwickler Anthropic hat zugegeben, dass seine Modelle in Testläufen unbeabsichtigt in die Computersysteme von drei Unternehmen eingedrungen sind.
Das Problem: Die KI hatte durch ein Missverständnis mit dem Testpartner direkten Internetzugang – und nutzte ihn.
Entdeckt wurde das Ganze erst später, bei einer Überprüfung von über 141.000 Testläufen.
Das geschah übrigens, nachdem OpenAI vor ein paar Wochen einen ähnlichen Vorfall hatte.
Der große Unterschied: Bei OpenAI musste die KI erst einen Weg aus der Sandbox finden.
Bei Anthropic stand die Tür von Anfang an offen.
Was bleibt: Die Diskussion, wie wir KI-Systeme sicher testen können, wird immer dringlicher – gerade wenn sie nicht nur Text schreiben, sondern aktiv in Systeme eingreifen sollen.
