Auch Google-KI Gemini soll versehentlich drei Unternehmen gehackt haben
Ein Sprachmodell aus Googles Gemini-Reihe hat während einer Cybersicherheitsübung unbefugter Weise auf Systeme dreier Unternehmen zugegriffen. Google bewertet den Vorfall nicht als Alignment-Problem. Laut dem Tech-Giganten hat die KI ihre Angriffe rechtzeitig abgebrochen.
Die Liste der Sicherheitsvorfälle in Zusammenhang mit KI-Modellen wird länger. Unlängst hat auch Gemini, das grosse Sprachmodell von Google, unbefugt auf die Systeme von drei Unternehmen zugegriffen. Der Vorfall ereignete sich im Rahmen einer von der Firma irregular organisierten Cybersicherheitsübung, wie das "Wall Street Journal" (Paywall) berichtet.
Laut der US-amerikanischen Zeitung handelt es sich um den ersten bekannten Fall, bei dem ein KI-System von Google autonom versuchte, reale Infrastrukturen zu infiltrieren.
Im Rahmen der "Capture The Flag"-Übung sollte Gemini Informationen bei einem fiktiven Unternehmen beschaffen, das in der Testumgebung von Irregular gehostet wurde. Dieses trug allerdings denselben Namen wie ein reales Unternehmen. Zudem war versehentlich eine Internetverbindung zugänglich geblieben, die eigentlich nicht hätte verfügbar sein dürfen.
In einem ersten Fall erriet Gemini ein Passwort, mit dem es auf den Dienst eines realen Unternehmens zugreifen konnte. Bei zwei weiteren Durchläufen des Tests führte das Modell Recherchen im Web durch und entdeckte in öffentlichen Repositories Zugangsdaten, die anderen Unternehmen gehörten. Anschliessend setzte es diese erfolgreich ein.
Google beschwichtigt.
Google gibt an, das Modell habe jeden Angriff abgebrochen, sobald es erkannt habe, dass es auf reale Systeme zugegriffen hatte. Die drei betroffenen Unternehmen habe man ebenso informiert wie die US-Bundesbehörden. Google gab weder die Identität der Unternehmen bekannt, noch teilte der Konzern mit, welche Version von Gemini an dem Test beteiligt war.
Google sieht in den Vorfällen keine Hinweise auf eine "Fehlausrichtung" seiner KI-Modelle. Vielmehr findet das Unternehmen, dass dessen Sicherheitsmechanismen funktioniert hätten, da Gemini die Angriffe von sich aus beendet habe. Gegenüber dem "Wall Street Journal" kontert Jack Cable, CEO des Sicherheitsunternehmens Corridor, das Hauptproblem sei, dass ein KI-Agent versehentlich den vorgesehenen Rahmen verlassen und echte Cyberangriffe durchgeführt habe.
In jüngster Zeit räumten auch die KI-Anbieter OpenAI, Anthropic oder Meta ein, ihre KI-Modelle hätten autonom fremde Unternehmen gehackt oder Phishing-Angriffe gestartet. Wie OpenAI verhindern will, dass sich solches wiederholt, erfahren Sie hier.
Wenn Sie mehr zu Cybercrime und Cybersecurity lesen möchten, melden Sie sich hier für den Newsletter von Swisscybersecurity.net an. Auf dem Portal lesen Sie täglich News über aktuelle Bedrohungen und neue Abwehrstrategien.
IBM schliesst sich der SCION Association an
Swiss Post Cybersecurity lanciert Lösung zur Verwaltung digitaler Zertifikate
Neuer Apple-CEO am Aura-Farmen
Täter und Opfer - die zwei Gesichter der KI-Agenten
Putin bedient Windows-PC
Auch Google-KI Gemini soll versehentlich drei Unternehmen gehackt haben
Weshalb man Anzeigen nicht mit KI schreiben sollte
Zero-Click-Schwachstelle bedroht User aller grossen Coding-Agenten
Gefälschte Support-Konten nehmen frustrierte Flugreisende ins Visier