Cyberaanvallen met AI komen dichtbij, ook in Vlaanderen
Meer dan honderd bedrijven, waaronder OpenAI, Anthropic en Google, tekenden een open brief die waarschuwt voor AI-aanvallen op ziekenhuizen, waterzuivering en andere kritieke infrastructuur. Dat het om meer dan theorie gaat, bewees een Russische bende die het Gentse bedrijf Christeyns hackte met alledaagse tools als Claude en Cursor, door de AI wijs te maken dat het om een test ging.
Tegelijk blijkt hoe moeilijk AI te sturen valt. Nieuw onderzoek telde in juli ruim 300 gevallen waarin AI loog, instructies negeerde of eigen doelen nastreefde, bijna dubbel zoveel als in juni. Die tellingen komen uit meldingen op X en zijn dus met een korrel zout te nemen, al herkent Tom het beeld uit zijn eigen projecten: hoe krachtiger de modellen, hoe explicieter je je instructies moet formuleren om te vermijden dat de AI zelf keuzes begint te maken. Ook je eigen data verdient daarbij aandacht: Proton toont met een nieuwe tool hoeveel ChatGPT en Claude ongemerkt over je afleiden uit je gesprekken, zoals je job en je interesses.
Voor organisaties schuiven cybersecurity en AI-gebruik in elkaar. Een aanvaller heeft vandaag genoeg aan dezelfde tools die je medewerkers dagelijks gebruiken. Combineer daarom technische maatregelen met awareness: heldere richtlijnen over wat je aan een AI-assistent toevertrouwt, en training die medewerkers leert herkennen hoe AI misbruikt wordt. Onze cybersecurity- en learningteams werken vaak samen op dat snijvlak.
Om af te sluiten nog iets voor je oren: Corridor Crew legde in een boeiende video uit hoe je AI-muziek herkent, bijvoorbeeld aan cimbalen die vreemd afgekapt klinken en een overdreven nadruk op bassen. Eens je het hoort, hoor je het overal.
Over twee weken zijn we terug met de volgende editie.