Neurocourse

Privatliv og sikkerhed: hvad du kan og ikke kan lægge i AI

Gratis AI-værktøjer kan bruge dine samtaler til træning. Beskyt fortrolige data, kortlæg 'rød zone', og mestr de-identifikation og privatlivsindstillinger. Undgå lækager.

I den sidste lektion — den om din første prompt — gav jeg en kort advarsel: indsæt ikke fortrolige data i gratis AI-chats. Det er en vigtig pointe, så lad os se nærmere på den. Dette er den mest undervurderede begynderfejl, og selv store virksomheder begår den.

Hvor er risikoen, helt præcist?

Husk lektionen om, hvordan et netværk lærer: en model vokser på de data, den bliver vist. Hos mange tjenester er standardreglen for gratis abonnementer, at dine samtaler kan bruges til at træne fremtidige versioner af modellen. Du indsætter tekst i chatboksen, og den sendes til virksomhedens servere, hvor den kan blive gennemgået under kvalitetskontrol og indgå i træningsdataene. Fortrolige data er alt, du ikke ønsker, at udenforstående skal se: adgangskoder, kundelister, interne dokumenter, kommercielle vilkår. Sender du det til en gratis chat, har du reelt taget det ud af kontoret.

Vent et øjeblik: hvis din samtale kan ende i træningsdataene, hvor kunne en adgangskode eller teksten fra en privat kontrakt, du indsatte, så teoretisk dukke op igen senere?

Samsung, forår 2023: sådan ser det ud i virkeligheden

Historien er blevet en lærebogssag. I foråret 2023 fik ingeniører i en Samsung-division lov til at bruge ChatGPT til arbejde. Ifølge medierapporter skete der flere hændelser inden for få uger: medarbejdere indsatte intern kildekode og indholdet af et lukket internt møde i chatten — så AI'en kunne hjælpe med at finde en fejl og skrive noterne. Dataene røg til andres servere, og der er ingen måde at få dem tilbage på.

Virksomhedens reaktion var fast: Samsung begrænsede brugen af generativ AI på arbejdsenheder. Samme år indførte store banker og virksomheder, ifølge erhvervspressen, lignende restriktioner — JPMorgan og Apple var blandt de nævnte — bekymrede over præcis det samme.

Moralen er den samme som i lektionen om hallucinationer: personen er ansvarlig, ikke værktøjet. Dér var det den, der ikke tjekkede resultatet; her er det den, der ikke tænkte over, hvor teksten røg hen.

Den røde zone: hvad der aldrig må lægges ind

  • 🔑 Adgangskoder, nøgler, adgangskoder — aldrig, noget sted.
  • 👥 Personlige data. Personlige data er information, der kan identificere en specifik person: andres navne, telefonnumre, adresser, pas, medicinske journaler. Beskyttelse af dem er et spørgsmål om lov (GDPR i Europa, og de fleste lande har deres egne love om personlige data), og den, der forårsagede en lækage, er ansvarlig for det.
  • 📄 Forretningshemmeligheder. En forretningshemmelighed er information, der giver en virksomhed en fordel, netop fordi konkurrenterne ikke har den: private kontrakter, prissætning, økonomi, strategi, kildekode.
  • 🏥 Følsomme oplysninger om personer — sundhed, lønninger, privat korrespondance.

Den grønne zone: hvad der er sikkert at lægge ind

  • Tekst, der allerede er offentlig, eller som alligevel forberedes til offentliggørelse.
  • Dine egne udkast, uden andres hemmeligheder i.
  • Øvelsesopgaver og abstrakte spørgsmål.
  • Data, hvor alle identificerende detaljer er fjernet — hvilket er det næste.

Teknikken, der løser halvdelen af problemet: de-identifikation

De-identifikation (afpersonalisering) betyder at udskifte virkelige detaljer med pladsholdere, før noget sendes til AI'en. Skal du arbejde med en rigtig kontrakt? Erstat parterne med "Virksomhed A" og "Virksomhed B", fjern beløb og efternavne, behold substansen. For at hjælpe med strukturen af et brev eller finde et hul i et argument, behøver modellen ikke de virkelige navne og numre. Dette er den mest praktiske færdighed i lektionen: langt de fleste arbejdsopgaver kan sendes til AI de-identificeret — samme fordel, ingen risiko.

En vigtig forbehold. Hvad du gør, er pseudonymisering (udskiftning af navne med pladsholdere), ikke fuld anonymisering. Det mindsker risikoen, men fjerner ikke dit ansvar: fragmenter af data kan nogle gange stadig samles for at pege på en specifik person (det kaldes re-identifikation), og lovgivningen om personlige data (GDPR i Europa) gælder stadig. Så de-identifikation er det krævede minimum, men for ægte følsomt materiale skal du tilføje et business-abonnement og tjekke din virksomheds egen politik.

Tre regler værd at kende

  • Tjek dine privatlivsindstillinger. ChatGPT, Gemini og de andre har en indstilling, der slår brugen af dine chats til træning fra (ofte samlet med lagring af din historik). Find den — og slå den fra for arbejdsopgaver.
  • For arbejdsdata, brug business-abonnementer. På virksomheds- og teamabonnementer (Business/Enterprise) lover virksomheder generelt ikke at bruge dine data til træning. Hvis du håndterer noget følsomt, er det ikke en luksus, det er grundlæggende.
  • Hvis din virksomhed har en politik, gælder den. Mange arbejdsgivere har allerede nedskrevet, hvad der må og ikke må lægges i AI. Ikke sikker? Spørg, før du indsætter et arbejdsdokument.

En simpel hverdagsregel

Før du trykker send, stil dig selv ét spørgsmål: "Ville jeg være tryg ved, at en fremmed så denne tekst?" Hvis ja, indsæt det. Hvis du føler et gran af tvivl, de-identificer det først eller skift til et værktøj på et business-abonnement. Det tre-sekunders filter beskytter dig bedre end nogen teknisk foranstaltning — fordi beslutningen træffes, før du sender, ikke efter en lækage.

Gør dette nu

Tag en hvilken som helst rigtig arbejdstekst — en e-mail, en ansøgning, et stykke af en rapport — og øv dig i de-identifikation, lige der på papiret eller i dine noter. Gå den igennem og find alt, der tæller som personligt eller kommercielt: navne, telefonnumre, adresser, firmanavne, kontraktbeløb. Erstat hver med en pladsholder — "Kunde A", "Virksomhed B", "beløb N". Sammenlign de to versioner: den de-identificerede forklarer substansen lige så klart, men afslører intet. Gør dette én gang bevidst, og fremover vil din hånd automatisk rense teksten, før du sender den noget sted.

Practice · 3 задачи

Short questions on the lesson — with an explanation for every answer.