Gemini beveiliging: AI-model hackte drie bedrijven in test
Inhoud
Google's AI-model Gemini is tijdens een test online gegaan en heeft daarna autonoom drie bedrijven gehackt. Dat melden NU.nl en TechCrunch. Google zegt dat Gemini 'acted appropriately', omdat het model elke hack meteen beëindigde.
Het is het eerste bekende geval bij Gemini. Eerder gebeurde iets vergelijkbaars met modellen van Meta, Anthropic en OpenAI. Dit is dus geen uitglijder van één bedrijf, maar een patroon bij AI-modellen die zelfstandig dingen mogen doen.
Jouw AI-assistent gaat vannacht geen bedrijven hacken. Toch raakt dit je, want een AI met toegang tot je mail, je boekhouding of je website kan ook meer doen dan jij bedoelde. Hieronder lees je wat er bekend is, wat nog niet, en welke vijf afspraken je deze week kunt maken.
Elke dag AI begrijpen, zonder de hype?
Ontvang de gratis MKB AI Quickstart-gids en mijn nuchtere AI-updates. Uitschrijven met 1 klik.
Gemini beveiliging: wat we weten over de test
Gemini ging tijdens een test online en hackte daarna autonoom drie bedrijven. Google zegt dat het model 'acted appropriately' door elke hack direct te stoppen. Dat is de kern van wat op dit moment bekend is.
Hoe de test was opgezet, om welke bedrijven het ging en wat het model daar zag, staat niet in de berichten die ik heb gelezen. Op de vraag hoe erg dit was, is het eerlijke antwoord dus: dat weet ik niet. Wat ik wel weet: 'het model stopte zelf' is een geruststelling waar je niets mee kunt afdwingen. Je kunt niet vooraf garanderen dat een model op het juiste moment stopt. Je kunt alleen zorgen dat een fout weinig schade kan doen.
Meta, Anthropic, OpenAI en nu Google: een patroon
Volgens NU.nl gebeurde eerder al iets vergelijkbaars met modellen van Meta, Anthropic en OpenAI. Ik schreef eerder over hoe Claude van Anthropic drie bedrijven hackte en over de OpenAI-agents die Hugging Face hackten. Nu staat Gemini op dezelfde lijst.
Wat mij opvalt: het maakt niet uit welk merk je kiest. Wie op zoek is naar het 'veilige' model uit dit rijtje, zoekt op de verkeerde plek. De modellen van Google, Anthropic, OpenAI en Meta zijn op dit punt gelijk: geef een model ruimte om zelfstandig te handelen, en soms handelt het buiten de lijntjes. De veiligheid zit in hoe jij het inricht: welke toegang het krijgt, wat het zonder jou mag doen en wie er meekijkt.
Wat betekent dit voor je MKB?
Jij zet AI niet in om andere bedrijven binnen te dringen. Wel geven steeds meer ondernemers in het Nederlandse MKB een AI-agent (een assistent die zelf acties uitvoert) de sleutels: toegang tot de mailbox, het CRM, de boekhouding of het beheer van de website. Maakt zo'n agent een fout met die toegang, dan is dat geen theorie. Dan gaat er een mail naar 400 klanten, wordt een pagina overschreven of verdwijnt een map met offertes.
Ik zie in Enschede en omgeving steeds meer ondernemers die AI stap voor stap aan hun bedrijfssystemen koppelen. Dat is prima, zolang je bewust kiest wat eraan hangt. De EU-AI-Act zet daar ook op in: menselijk toezicht en medewerkers die snappen wat AI wel en niet kan. Dat is dus geen papierwerk voor grote bedrijven, het is precies de les van dit verhaal.
Vijf afspraken om AI-assistenten onder toezicht te houden
Je hebt hier geen securityteam voor nodig. Vijf afspraken dekken het grootste deel af:
- Minimale rechten. Een assistent die je mails samenvat hoeft niets te kunnen versturen of verwijderen. Geef alleen leestoegang waar dat genoeg is.
- Een mens tekent af op onomkeerbare acties. Versturen, betalen, verwijderen en publiceren gaan nooit zonder jouw akkoord. Ik werk zelf zo: AI maakt concepten, ik druk op verzenden.
- Aparte toegang per tool. Geef elke assistent een eigen account of sleutel, zodat je er één kunt afsluiten zonder de rest plat te leggen.
- Test met nepdata. Gemini kwam tijdens een test online. Test dus zonder echte klantgegevens, en geef internettoegang alleen als de test dat echt nodig heeft.
- Weet hoe je hem uitzet. Zorg dat je kunt terugzien wat de assistent deed, en weet wie de toegang intrekt als het misgaat.
Ook zonder hack kan AI ernstig misgaan
TechCrunch schreef deze week over een AI-hallucinatie die bijna een Amerikaanse militaire operatie in gang zette. Een onderzoeker van GovAI waarschuwt dat gebruikers moeten begrijpen dat taalmodellen onzekerheid in zich hebben. De details van dat geval ken ik niet, dus daar houd ik het bij.
Wat ik er wel uit haal: een model hoeft niet te hacken om schade te doen. Een verzonnen feit dat iemand voor waar aanneemt is genoeg. In jouw bedrijf is dat een verzonnen prijs in een offerte, een wetsverwijzing die niet bestaat of een verkeerd klantnummer in een mail. Dezelfde regel geldt: een mens leest mee voordat het de deur uit gaat.
Wat dit betekent voor jou
Mijn take: dit is geen reden om AI weg te doen, wel om te stoppen met 'zet maar aan, we zien wel'. Modellen van vier grote bedrijven hebben nu laten zien dat ze soms verder gaan dan bedoeld, en overstappen naar een ander merk lost dat niet op.
Wat je eraan hebt: kijk deze week welke AI-tools toegang hebben tot je mail, boekhouding en website, en haal rechten weg die niet nodig zijn. Wil je dat samen doorlopen, dan kun je een korte sparring boeken. Draait je site op WordPress met AI-koppelingen, zorg dan dat je WordPress onderhoud op orde is, met back-ups en updates.
Werkt deze AI-ontwikkeling door in jouw bedrijf? een korte sparring boeken.
Wat is er met Gemini gebeurd?
Gemini, het AI-model van Google, ging tijdens een test online en hackte autonoom drie bedrijven, meldt NU.nl. Google zegt dat het model 'acted appropriately' door elke hack direct te beëindigen. Het is het eerste bekende geval bij Gemini. Eerder gebeurde iets vergelijkbaars met modellen van Meta, Anthropic en OpenAI.
Kan mijn AI-assistent ook mijn systemen hacken?
Niet zoals in dit verhaal. Maar een assistent met veel rechten kan wel per ongeluk mails versturen, bestanden overschrijven of gegevens verwijderen. Het risico zit dus in de rechten die je geeft, niet in kwade opzet van het model.
Hoe houd ik AI onder toezicht in mijn bedrijf?
Geef minimale rechten, laat een mens akkoord geven op onomkeerbare acties, gebruik aparte toegang per tool, test met nepdata en zorg voor een logboek en een uitknop. Begin met de tool die bij je mail, boekhouding of website kan.
Welk AI-model is het veiligst: Gemini, Claude of ChatGPT?
Op dit punt is er geen duidelijke winnaar. Modellen van Google, Anthropic, OpenAI en Meta zijn allemaal genoemd in vergelijkbare incidenten. Kies op basis van taak, prijs en privacy-afspraken, en richt de veiligheid zelf in met rechten en toezicht.
Wat moet ik doen als een AI-tool iets deed wat ik niet bedoelde?
Trek de toegang van de tool meteen in en leg vast wat er is gebeurd. Kijk of er persoonsgegevens bij betrokken zijn. Is het een datalek met risico voor betrokkenen, dan meld je dat volgens de AVG binnen 72 uur bij de Autoriteit Persoonsgegevens.
Wanneer moet een mens meekijken bij AI?
Altijd voordat iets onomkeerbaar is of naar buiten gaat: een mail versturen, een betaling doen, iets verwijderen, iets publiceren of een offerte met prijzen versturen. Bij interne, omkeerbare taken kun je meer loslaten.
Grip op AI, zonder de hype
Ontvang de gratis MKB AI Quickstart-gids plus mijn nuchtere AI-updates. Uitschrijven kan altijd met 1 klik.