Hva er en underdatabehandler?

Av Weapp · Oppdatert

En underdatabehandler, også kalt underleverandør, er databehandlerens egen leverandør i behandlingskjeden, altså leverandøren bak leverandøren deres. I AI-sammenheng avgjør kjeden, ikke logoen, hvor data og ansvar havner: Bruker dere en modell via en skyplattform, blir hyperscaleren databehandler og modelleverandøren underleverandør. Kunden har rett til å se hele kjeden i databehandleravtalen.

Når du kjøper en AI-tjeneste, kjøper du sjelden bare fra ett selskap. Bak leverandøren finnes det en kjede av underleverandører som også behandler dataene dine. Underdatabehandler, eller underleverandør, er navnet på det leddet, og det er ofte der de virkelige personvernspørsmålene skjuler seg, langt fra logoen på fakturaen.

Definisjonen

En underdatabehandler er databehandlerens egen leverandør i behandlingskjeden. Datatilsynet omtaler den som en underleverandør, og det er ordet vi bruker videre. Dere er behandlingsansvarlige, leverandøren deres er databehandler, og de leverandørene som databehandleren i sin tur bruker for å levere tjenesten, er underleverandører.

Det viktige er prinsippet: Det er kjeden, ikke merkevaren, som avgjør hvor data ligger og hvilket ansvar som gjelder. To tjenester med samme logo utad kan ha helt ulike kjeder av underleverandører, og dermed ulik jurisdiksjon og risiko. Den som bare ser på navnet til leverandøren, ser bare toppen av kjeden.

For dere som behandlingsansvarlige er ikke dette en teoretisk finesse. Ansvaret for hele kjeden ligger til syvende og sist hos dere: Velger dere en leverandør, velger dere indirekte også leverandørens underleverandører. Det merkes konkret i protokollen over behandlingsaktiviteter, der hver behandling skal kunne knyttes til hvor dataene faktisk havner, og ved en eventuell kontroll, der dere må kunne gjøre rede for leddene, ikke bare navngi den direkte leverandøren. Å forstå begrepet underleverandør er derfor en forutsetning for å kunne dokumentere AI-tjenestene deres korrekt.

AI-eksemplene som gjør det konkret

I AI-verdenen blir dette fort håndgripelig fordi modellene ofte kjøres via skyplattformer:

  • Kjører dere Claude via AWS Bedrock, blir AWS databehandler i leddet og Anthropic underleverandør. Dataene går gjennom Amazons infrastruktur, med Anthropics modell lenger inn i kjeden.
  • Kjører dere OpenAI, er Microsoft Azure den primære underleverandøren. Det betyr at OpenAI-data har amerikansk eksponering også når dere har valgt lagring i EU. Underleverandøren trekker inn en jurisdiksjon som lagringsvalget ikke fjerner.

Poenget er at jurisdiksjon og eksponering følger kjeden. Et scenario: Et selskap velger en AI-tjeneste med europeisk profil og antar at dataene blir værende i EU. Kartleggingen av underleverandører viser at ett ledd i kjeden ligger i USA, og at CLOUD Act dermed er relevant, til tross for den europeiske fasaden.

Kundens rettigheter i databehandleravtalen

Fordi kjeden er avgjørende, må du kunne se den. En korrekt databehandleravtale (DPA) gir deg tre ting:

  1. En oppdatert liste over underleverandører: hvilke underleverandører som inngår akkurat nå.
  2. Varsel ved endringer: beskjed når leverandøren legger til eller bytter underleverandør.
  3. Rett til å protestere: mulighet til å motsette deg en ny underleverandør du ikke godtar.

Mangler disse rettighetene i avtalen, er det et faresignal. Uten dem mister du innsyn i og kontroll over den nedre delen av kjeden, der en stor del av risikoen faktisk ligger.

Multimodellplattformer gir flere kjeder

En siste ting å holde styr på: multimodellplattformer. En tjeneste som gir tilgang til modeller fra flere leverandører, skaper flere parallelle kjeder av underleverandører, hver med sin jurisdiksjon.

Da holder det ikke å kartlegge plattformen som om den var én enkelt leverandør. Hver modellvei har sin egen kjede, og alle disse skal inn i protokollen over behandlingsaktiviteter. En virksomhet som bruker flere modeller, må altså dokumentere flere kjeder parallelt.

Slik kartlegger du kjeden

For å få kontroll over underleverandørene gjør du slik i praksis:

  1. Ta utgangspunkt i dataene, ikke logoen. Følg den faktiske flyten: Hvor går prompten, hvilken infrastruktur behandler den, hvilken modell svarer? Det er den veien som avgjør jurisdiksjonen.
  2. Be om listen over underleverandører. Sammenlign den med flyten. Stemmer leddene du har funnet, med det leverandøren oppgir? Mangler noe, er det verdt et spørsmål.
  3. Noter jurisdiksjonen per ledd. Marker hvilke ledd som ligger utenfor EØS og hvilken eksponering det medfører, for eksempel via CLOUD Act.
  4. Før inn hver kjede i protokollen over behandlingsaktiviteter. Bruker dere flere modeller eller plattformer, blir det flere kjeder, og alle skal dokumenteres, ikke bare den mest synlige.

Vil du se hvordan spørsmålet om underleverandører henger sammen med dataresidens, overføringsgrunnlag og myndighetstilgang i et helt AI-prosjekt, finner du mer på AI-siden vår. Trenger du hjelp til å kartlegge kjedene av underleverandører for AI-tjenestene deres? Ta kontakt.

Ofte stilte spørsmål

Hva er forskjellen på en databehandler og en underdatabehandler?

En databehandler behandler personopplysninger på vegne av dere, den behandlingsansvarlige. En underdatabehandler, eller underleverandør, er i sin tur databehandlerens egen leverandør, lenger ned i kjeden. Eksempel: Kjøper dere en AI-tjeneste, er leverandøren databehandler, og skyplattformen leverandøren selv bruker, blir underleverandør. Ansvaret og beskyttelsen må følge med gjennom hele kjeden.

Hvorfor spiller det noen rolle hvem underleverandørene er?

Fordi det er kjeden, ikke merkevaren, som avgjør hvor data faktisk behandles og hvilken jurisdiksjon som gjelder. En europeisk leverandør kan ha amerikanske underleverandører som trekker inn CLOUD Act-eksponering. Uten oversikt over underleverandørene vet dere ikke hvor dataene egentlig havner. Logoen på fakturaen sier for lite.

Har jeg rett til å få vite hvilke underleverandører som brukes?

Ja. En korrekt databehandleravtale (DPA) gir dere rett til en oppdatert liste over underleverandører, til varsel ved endringer og til å protestere mot nye underleverandører. Mangler disse rettighetene i avtalen, er det et faresignal: Dere mister innsyn i og kontroll over den nedre delen av behandlingskjeden.

Hvordan påvirker multimodellplattformer kjeden av underleverandører?

De skaper flere parallelle kjeder. En plattform som gir tilgang til modeller fra ulike leverandører, betyr at hver modellvei har sin egen kjede av underleverandører og sin egen jurisdiksjon. Alle disse kjedene må inn i protokollen over behandlingsaktiviteter. Det holder ikke å kartlegge plattformen som om den var én enkelt leverandør.

Blir skyleverandøren underleverandør når jeg kjører en AI-modell der?

Ofte ja. Kjører dere for eksempel Claude via AWS Bedrock, blir AWS databehandler i leddet og Anthropic underleverandør. Kjører dere OpenAI, er Microsoft Azure den primære underleverandøren, og det gjør at OpenAI-data har amerikansk eksponering selv med lagring i EU. Hvem som er hva, avhenger av hvordan tjenesten er satt opp.