Google hat zugegeben, dass sein Modell der künstlichen Intelligenz (KI) Gemini ebenfalls für einen „Hack“ bei drei echten Unternehmen verantwortlich war, nachdem es aufgrund eines Fehlers aus seiner Testumgebung entkommen war, wodurch es Zugang zum Internet erlangte – und reiht sich damit in ähnliche Vorfälle ein, über die OpenAI, Anthropic und Meta berichtet haben.
Im Rahmen der Tests wurde Gemini aufgefordert, Informationen über ein fiktives Unternehmen zu beschaffen; das Modell gelangte jedoch schließlich zu einem realen Unternehmen, das zufällig denselben Namen trägt, indem es eine Sicherheitslücke in der Testumgebung ausnutzte, um auf das Internet zuzugreifen.
Dies hat Google in einer Stellungnahme gegenüber The Wall Street Journal konkretisiert und erklärt, dass diese Vorfälle im Mai im Rahmen eines Tests in der Infrastruktur von Irregular auftraten – demselben Unternehmen, das auch für die Tests mit KI-Modellen anderer Firmen wie OpenAI und Anthropic zuständig ist.
Konkret wurden drei Vorfälle identifiziert, die von Gemini beim Testen einer als „Capture the Flag“ bekannten Simulation ausgelöst wurden. In einem dieser Fälle versuchte das Modell, Passwörter zu erraten, bis es Zugang zu einem geschützten System eines realen Unternehmens erhielt. Die beiden anderen Vorfälle beruhten darauf, dass das Modell im Internet nach dem Namen des betreffenden Unternehmens suchte und in einem öffentlichen Repository Anmeldedaten anderer Unternehmen fand, wodurch es ebenfalls Zugriff auf geschützte Systeme zweier weiterer Unternehmen erlangte.
In allen Fällen konnte das Modell zwar nicht auf das Internet zugreifen und musste in der Testumgebung isoliert bleiben, doch ein Fehler im Testsystem ermöglichte es Gemini, „unbeabsichtigt“ eine Websuche durchzuführen. Zudem wurden diese Vorfälle mit einer früheren Version von Gemini durchgeführt.
Trotz dieser unbefugten Zugriffe versicherte Google, dass Gemini seine Aktivitäten eingestellt habe, sobald es festgestellt habe, dass es auf die Systeme realer Unternehmen zugegriffen habe. Auch wenn Google die Namen der „gehackten“ Unternehmen nicht bekannt gegeben hat, teilte es mit, dass alle drei über diese Vorfälle informiert worden seien. Irregular hat seinerseits gegenüber The Wall Street Journal erklärt, dass die Probleme in seinem Testsystem „vor Wochen“ behoben worden seien.
Google hat jedoch erläutert, dass Irregular ihm diese Vorfälle Ende Juli gemeldet habe, nachdem Hugging Face von den OpenAI-Modellen „gehackt“ worden war, obwohl der Technologieriese dies bisher in Aussagen gegenüber der genannten Zeitung nicht erwähnt hatte. Wie Google erklärte, liege dies daran, dass man die aufgetretenen „Hacks“ nicht als Fehler betrachte, da sie den betroffenen Unternehmen keinen Schaden zugefügt hätten und das Modell seine Aktivität sofort unterbrochen habe, sobald es bemerkte, dass es auf ein echtes Unternehmen zugegriffen hatte, anstatt in der Testumgebung mit simulierten Unternehmen weiterzuarbeiten.
„In diesem Fall hat das Modell angemessen gehandelt“, versicherte Heather Adkins, Vizepräsidentin für Sicherheitstechnik bei Google, gegenüber dem genannten Medium und betonte zugleich, dass solche Vorfälle „die Bedeutung des Trainings leistungsfähiger KI-Modelle unterstreichen, damit diese verantwortungsbewusst handeln“.
Es handelt sich um den ersten bekannten Fall, in dem ein KI-Modell von Google während eines Cybersicherheitstests außer Kontrolle geriet, allerdings ist anzumerken, dass dies parallel zu anderen Vorfällen bei Modellen anderer Unternehmen der Branche geschah, wie dem bereits erwähnten „Hack“ von GPT-5.6 Sol bei Hugging Face, auf den der Zugriff auf weitere Dienste folgte, sowie kürzlich sechs neuen Fällen von Fehlverhalten, die im Rahmen einer neuen Strategie zur „Verfolgung, Untersuchung und Offenlegung von Fällen von Modellfehlverhalten“ veröffentlicht wurden. Auch Unternehmen wie Anthropic und Meta waren von Vorfällen mit demselben Vorgehensweise betroffen; deren Modelle gerieten ebenfalls außer Kontrolle und hackten in den letzten Monaten schließlich andere Unternehmen.
Quelle: Agenturen




