Hvad er abuse monitoring?
Abuse monitoring, misbrugsdetektion, er når en AI-leverandør beholder prompts og svar i en periode for at opdage brud på sin brugspolitik. Det forklarer hvorfor løftet om at der ikke trænes på data, ikke er det samme som at data ikke gemmes. I underlaget er standarden typisk op til 30 dages lagring.
Mange AI-leverandører siger tydeligt at de ikke træner deres modeller på dine data. Det lyder som om spørgsmålet om datalagring dermed er løst. Det er det ikke, og abuse monitoring er grunden. Begrebet forklarer hvorfor “ingen træning” og “ingen lagring” er to helt forskellige løfter, og hvorfor du skal bede om det andet separat.
Hvad abuse monitoring er
Abuse monitoring, misbrugsdetektion, betyder at leverandøren beholder dine prompts og modellens svar i en periode for at kunne opdage brud på brugspolitikken, f.eks. forsøg på at misbruge tjenesten eller omgå dens beskyttelse. Data gemmes altså ikke for at forbedre modellen, men for at leverandøren kan gennemgå og gribe ind over for misbrug.
I vores underlag er standarden typisk op til 30 dages lagring, hvorefter data slettes hvis intet er markeret. Det er en sikkerhedsmekanisme, og den er slået til som standard hos flere leverandører, også når træning udtrykkeligt er slået fra.
Derfor betyder “ingen træning” ikke “ingen lagring”
Det er den vigtigste pointe. Træning og lagring er to adskilte spørgsmål, og et svar på det ene siger intet om det andet.
En leverandør kan helt korrekt love at dine data aldrig bruges til at træne modeller, og samtidig gemme hver prompt i 30 dage til misbrugsdetektion. Løftet om ingen træning er da sandt, men data gemmes alligevel. Hvis du håndterer følsomme oplysninger, er det lagringen, ikke træningen, der ofte er det afgørende spørgsmål. Hvem kan læse data i de dage, hvor gemmes de, og under hvilken jurisdiktion?
Den der nøjes med “vi træner ikke på dine data” og tror at spørgsmålet om lagring dermed er afklaret, har overset halvdelen af billedet. Spørg altid udtrykkeligt ind til lagringen.
Undtagelser er en ansøgning, ikke en knap
En udbredt misforståelse er at man kan slå lagringen fra i konsollen. Sådan fungerer det sjældent. Modificeret overvågning eller zero data retention (ZDR) er en ansøgningsproces med godkendelse: en rettighed du aftaler dig til, ikke en indstilling du selv slår fra.
Hvordan det foregår, er forskelligt fra leverandør til leverandør:
| Leverandør | Sådan får du en undtagelse |
|---|---|
| OpenAI | Godkendelse via salgsafdelingen. En proces, ikke en selvbetjeningsindstilling |
| Azure OpenAI | Ansøgning om Limited Access, med betingelser som ContentLogging=false som dokumentation |
Pointen er at undtagelsen kræver aktiv sagsbehandling hos leverandøren og efterlader et aftalt spor. Regn med en behandlingstid, og regn med at skulle dokumentere hvorfor I har brug for den.
Hvor overvågningen sker, har betydning
En detalje der let overses: Stedet for detektionen afgør hvor dine prompts faktisk havner. Det er ikke nok at vide hvor modellen kører. Du skal vide hvor overvågningen og lagringen sker.
Et konkret eksempel fra underlaget: På Bedrock gemmes misbrugsdata i destinationsregionen inden for geografien. Det kan afvige fra hvor du gik ud fra at behandlingen fandt sted. Derfor er det rigtige spørgsmål ikke kun “hvor kører modellen?”, men “hvor sker overvågningen, og hvor gemmes det der indsamles?”.
Hvad det betyder for følsomme data
For en organisation der sender personoplysninger eller forretningshemmeligheder til en AI-tjeneste, bliver abuse monitoring et konkret spørgsmål der skal håndteres, ikke en teknisk fodnote. Et scenarie: I bygger en intern assistent der slår op i jeres dokumenter og fører følsomt indhold ind i prompten. Selv med træning slået fra kan hver sådan prompt blive gemt i op til 30 dage til misbrugsdetektion, og måske i en region I ikke havde regnet med.
Konklusionen er ikke at undgå tjenesterne, men at bygge med lagringen for øje. Minimér hvad der sendes ind, find ud af om modificeret overvågning eller zero data retention kan fås i jeres tilfælde, og dokumentér hvor data havner. Så bliver abuse monitoring en kendt og håndteret risiko i stedet for en ubehagelig overraskelse ved en gennemgang.
Tjek altid de aktuelle vilkår
En sidste, vigtig ting: Det her er et område i bevægelse. Både lagringstider og hvilke endpoints der er undtaget, ændrer sig over tid når leverandørerne opdaterer deres vilkår. Et tal eller en undtagelse der passede for et halvt år siden, kan være forældet i dag.
Behandl derfor alle oplysninger om retention som en ferskvare, og tjek leverandørens aktuelle vilkår før I træffer beslutninger. Vil du have hjælp til at gennemgå spørgsmålene om lagring og overvågning for en konkret AI-løsning, kan du læse mere om vores arbejde med AI eller kontakte os.
Ofte stillede spørgsmål
Betyder "ingen træning" at data ikke gemmes?
Nej, og det er præcis den misforståelse som abuse monitoring afslører. En leverandør kan love at dine data ikke bruges til at træne modeller, og alligevel gemme prompts og svar i en periode til misbrugsdetektion. Træning og lagring er to separate spørgsmål. At det ene er afklaret, siger intet om det andet.
Hvor længe gemmes data til abuse monitoring?
Det varierer fra leverandør til leverandør og kan ændre sig. I vores underlag er standarden typisk op til 30 dage, hvorefter data slettes hvis der ikke er markeret et brud på brugspolitikken. Da både lagringstider og undtagne endpoints ændrer sig over tid, bør du altid tjekke leverandørens aktuelle vilkår frem for at stole på et tal du har læst én gang.
Kan man slå abuse monitoring fra?
Ikke med et klik i konsollen. Modificeret overvågning eller zero data retention er en ansøgningsproces med godkendelse. Hos OpenAI kræver det en godkendelse via salgsafdelingen, og hos Azure søger man om Limited Access med betingelser som ContentLogging=false som dokumentation. Det er altså en aftalt rettighed, ikke en indstilling du selv slår fra.
Betyder det noget hvor abuse monitoring foregår geografisk?
Ja. Stedet for detektionen afgør hvor dine prompts faktisk havner. På Bedrock gemmes misbrugsdata i destinationsregionen inden for geografien, hvilket kan afvige fra hvor du tror at behandlingen sker. Spørg altid hvor overvågningen udføres, og hvor data gemmes, ikke kun hvor modellen kører.
Hvad bør vi spørge leverandøren om når det gælder abuse monitoring?
Spørg om tre ting: hvor længe prompts og svar gemmes, om det er muligt at få modificeret overvågning eller zero data retention og i så fald hvordan man ansøger, samt hvor detektionen og lagringen sker geografisk. Bed om skriftlige vilkår fordi både retention og undtagne endpoints ændrer sig over tid.