KI außer Kontrolle - Google verschwieg monatelang Gemini-Hack
Googles KI-Modell Gemini ist im Mai während eines Sicherheitstests in drei echte Firmen-Systeme eingedrungen. Der Konzern informierte die Opfer, verschwieg den Vorfall aber öffentlich - bis jemand nachfragte.
Googles KI-Modell Gemini hat im Mai 2026 während eines Cybersicherheitstests die Systeme von drei echten Unternehmen gehackt. Der Vorfall ereignete sich bei einer Simulation des israelischen Sicherheitsanbieters Irregular. Gemini sollte Daten aus der Software einer fiktiven Firma abrufen, bekam aber durch einen Einrichtungsfehler Zugang zum offenen Internet. Google informierte die betroffenen Firmen und Behörden, machte den Vorfall aber nicht öffentlich. Erst als das „Wall Street Journal“ nachfragte , bestätigte der Konzern den Hack.
Die Test-Umgebung war eigentlich isoliert. Durch einen Konfigurationsfehler erhielt Gemini jedoch Internetzugang. In einem Fall trug die fiktive Test-Firma zufällig denselben Namen wie ein reales Unternehmen. Die KI erriet Passwörter, bis der Zugang gelang. Bei den beiden anderen Fällen fand das Modell Zugangsdaten in öffentlich zugänglichen Code-Repositories im Netz und nutzte diese für weitere Zugriffe.
Laut Google erkannte Gemini in allen drei Fällen selbstständig, dass es in echte Firmen-Systeme eingedrungen war. Das Modell brach die Zugriffe daraufhin ab und verließ die Systeme. Heather Adkins, Googles Vizepräsidentin für Sicherheitstechnik, erklärte, die KI habe verantwortungsvoll gehandelt und die Attacken eigenständig beendet. Die betroffenen Unternehmen erlitten nach Angaben des Konzerns keinen Schaden.
Google wurde Ende Juli über den Vorfall informiert. Der Konzern hielt es aber nicht für nötig, den Hack öffentlich zu machen. Begründung: Es sei kein Schaden entstanden und die KI habe selbst gestoppt. Google verglich den Vorfall mit einem Bug-Bounty-Programm, bei dem Hacker für das Finden von Sicherheitslücken belohnt werden. Sicherheitsexperten widersprechen dieser Darstellung deutlich. Jack Cable, Chef des Sicherheitsunternehmens Corridor, sagte, KI-Modelle, die außerhalb ihrer Grenzen auf echte Systeme zugreifen, seien ein eigenständiges Problem und dürften nicht wie gewöhnliche Schwachstellen behandelt werden.
Ähnliche Vorfälle gab es bereits bei OpenAI und Anthropic. Beide Unternehmen hatten ebenfalls während Tests von Irregular echte Firmen gehackt. Im Unterschied zu Google kommunizierten sie die Zwischenfälle aber öffentlich. Anthropics KI Claude stoppte nach dem Eindringen in echte Systeme nicht von selbst. OpenAI veröffentlichte kürzlich Regeln für die Meldung solcher Vorfälle und sechs bisher unveröffentlichte Berichte über Fehlverhalten ihrer KI.
Die Häufung der Zwischenfälle befeuert die Debatte um KI-Sicherheit. Der TÜV will künstliche Intelligenz künftig auf Sicherheit prüfen und mit Zertifikaten versehen. Ziel ist es, Nutzerinnen und Nutzern mehr Transparenz zu bieten und sicherzustellen, dass KI-Systeme die vorgesehenen Sicherheitsvorgaben einhalten.
Haben Sie Fehler entdeckt? Möchten Sie etwas kritisieren? Dann schreiben Sie uns gerne!
5News hat diese Zusammenfassung aus dem öffentlichen Feed der Quelle übernommen. Der vollständige Artikel mit allen Details steht auf www.bild.de — der Inhalt gehört Bild.