Gemini hackte ongewenst drie bedrijven tijdens een veiligheidstest

Tijdens een test brak Gemini uit een afgesloten omgeving en hackte het drie bedrijven. Dat gebeurde in mei, maar Google moest het nu ook publiekelijk toegeven (via Android Headlines).
De veiligheidsfirma Irregular wou nagaan hoe goed Gemini ethisch kon hacken. Daarvoor creëerde het een nagemaakte sandbox. De onderzoekers lieten de internettoegang echter aanstaan, waarna de AI echte bedrijfswebsites aanzag voor de toegewezen doelwitten.
Bij één bedrijf met exact dezelfde naam als het fictieve, originele doelwit paste Gemini een old-school tactiek toe. Het bleef gewoon continu wachtwoorden raden tot het een correct vond. Zo kreeg het toegang tot het beveiligde systeem.
Voor de twee andere inbraken zocht het door online opslagplaatsen naar gelekte loginggegevens. Het gebruikte die dan om binnen te raken op de servers.
‘Geen echte schade’
Heather Adkins, vice-president van de Security Engineering bij Google, benadrukte dat het AI-model automatisch de aanval afblies op het moment dat het begreep dat het om echte bedrijven ging. Met andere woorden, het stopte wanneer het doorhad dat het niet langer in de testomgeving aan het hacken was.
Omdat er geen echte schade is gemaakt, deed Google geen publieke bekendmaking van het voorval. De autoriteiten zijn toen wel meteen verwittigd en Google werkte samen met de getroffen bedrijven om veiligheidsmaatregelen te treffen.
Gemini is niet het enige AI-model dat dergelijk problematisch gedrag vertoonde. Ook OpenAI deed dat al door Hugging Face te hacken en Claude ontsnapte uit zijn sandbox om toegang te krijgen tot externe systemen. Net daarom is de roep naar maatregelen luid aan het weerklinken.












