Jeg har hørt at kunstig intelligens kan hackes. Hvilke typer af cyberangreb er AI-systemer egentlig særligt udsat for?

Når vi taler om sikkerhed omkring kunstig intelligens, er der nogle helt specifikke metoder, som hackere benytter. En af de mest kendte er prompt injection. Det fungerer ved, at man skriver en besked til AI'en, der manipulerer den til at ignorere sine normale regler og i stedet gøre noget, den egentlig ikke er programmeret til, som for eksempel at udlevere fortrolige oplysninger.

En anden risiko er såkaldt data poisoning. Her forsøger man at ødelægge AI'en ved at fodre den med forkert eller misvisende data under træningen. Hvis en AI lærer fra dårlige data, vil dens svar blive upålidelige eller direkte forkerte. Dette gør selve fundamentet for modellens logik usikkert.

Derudover findes der angreb, hvor man forsøger at udtrække de data, som AI'en er trænet på, ofte kaldet model inversion eller extraction. Her forsøger man at få maskinen til at afsløre følsomme informationer ved at stille meget målrettede spørgsmål. For at beskytte sig mod dette er det vigtigt, at virksomheder både sikrer deres data og overvåger, hvordan brugerne interagerer med systemerne, så man kan opdage mistænkelig adfærd i tide.}