Neurocourse

Privacy en veiligheid: wat je wel en niet in AI mag invoeren

Gratis AI-tools gebruiken je data voor training. Voer nooit vertrouwelijke info in. Leer de 'rode zone', de-identificatie en privacy-instellingen. Zo blijft AI een hulp, geen lek.

In de vorige les — die over je eerste prompt — gaf ik een korte waarschuwing: plak geen vertrouwelijke gegevens in gratis AI-chats. Het is een belangrijke waarschuwing, dus laten we die eens goed bekijken. Dit is de meest onderschatte beginnersfout, en zelfs grote bedrijven maken hem.

Waar zit het risico precies?

Herinner je de les over hoe een netwerk leert: een model groeit op basis van de gegevens die het te zien krijgt. Bij veel diensten is de standaardregel voor gratis abonnementen dat je gesprekken gebruikt mogen worden om toekomstige versies van het model te trainen. Je plakt tekst in het chatvenster en die gaat naar de servers van het bedrijf, waar het tijdens kwaliteitscontroles bekeken kan worden en in de trainingsgegevens kan worden opgenomen. Vertrouwelijke gegevens zijn alles wat je niet wilt dat buitenstaanders zien: wachtwoorden, klantenlijsten, interne documenten, commerciële voorwaarden. Stuur dat naar een gratis chat en je hebt het effectief het kantoor uit gedragen.

Wacht even: als je gesprek in de trainingsgegevens terecht kan komen, waar zou een wachtwoord of de tekst van een privécontract dat je hebt geplakt dan theoretisch later weer kunnen opduiken?

Samsung, voorjaar 2023: hoe dit er in de praktijk uitziet

Het verhaal is een schoolvoorbeeld geworden. In het voorjaar van 2023 mochten ingenieurs van een Samsung-divisie ChatGPT gebruiken voor hun werk. Volgens mediaberichten vonden er binnen enkele weken verschillende incidenten plaats: medewerkers plakten interne broncode en de inhoud van een besloten interne vergadering in de chat — zodat de AI kon helpen een bug te vinden en de notulen op te stellen.

De gegevens gingen naar servers van iemand anders, en die krijg je niet meer terug. De reactie van het bedrijf was resoluut: Samsung beperkte het gebruik van generatieve AI op werkapparaten. Datzelfde jaar, volgens de zakenpers, voerden grote banken en bedrijven vergelijkbare beperkingen in — JPMorgan en Apple werden genoemd — bezorgd over precies hetzelfde.

De moraal is hetzelfde als in de les over hallucinaties: de persoon is verantwoordelijk, niet de tool. Daar was het degene die het resultaat niet controleerde; hier is het degene die niet nadacht over waar hun tekst naartoe ging.

De rode zone: wat er nooit in mag

  • 🔑 Wachtwoorden, sleutels, toegangscodes — nooit, nergens.
  • 👥 Persoonsgegevens. Persoonsgegevens zijn informatie die een specifieke persoon kan identificeren: namen van anderen, telefoonnummers, adressen, paspoorten, medische dossiers. Het beschermen ervan is een wettelijke kwestie (AVG in Europa, en de meeste landen hebben hun eigen wetten voor persoonsgegevens), en degene die een lek veroorzaakt, is daarvoor verantwoordelijk.
  • 📄 Bedrijfsgeheimen. Een bedrijfsgeheim is informatie die een bedrijf een voordeel geeft juist omdat concurrenten het niet hebben: privécontracten, prijzen, financiën, strategie, broncode.
  • 🏥 Gevoelige zaken over mensen — gezondheid, salarissen, privécorrespondentie.

De groene zone: wat je veilig kunt invoeren

  • Tekst die al openbaar is of sowieso wordt voorbereid voor publicatie.
  • Je eigen concepten, zonder geheimen van anderen.
  • Oefenopgaven en abstracte vragen.
  • Gegevens waarvan elk identificerend detail is verwijderd — dat is het volgende.

De techniek die de helft van het probleem oplost: de-identificatie

De-identificatie (depersonalisatie) betekent het vervangen van echte details door plaatsaanduidingen voordat iets naar de AI gaat. Moet je een echt contract doornemen? Vervang de partijen door "Bedrijf A" en "Bedrijf B", haal de bedragen en achternamen eruit, behoud de inhoud. Om te helpen met de structuur van een brief of om een gat in een argument te vinden, heeft het model de echte namen en nummers niet nodig. Dit is de meest praktische vaardigheid in de les: de overgrote meerderheid van werktaken kan gede-identificeerd naar AI — hetzelfde voordeel, geen risico.

Een belangrijke kanttekening. Wat je doet is pseudonimisering (namen vervangen door plaatsaanduidingen), niet volledige anonimisering. Het verlaagt het risico, maar neemt je verantwoordelijkheid niet weg: fragmenten van gegevens kunnen soms nog steeds aan elkaar worden gekoppeld om naar een specifieke persoon te verwijzen (dat heet re-identificatie), en de wetgeving inzake persoonsgegevens (AVG in Europa) blijft van toepassing. De-identificatie is dus het vereiste minimum, maar voeg voor echt gevoelig materiaal een zakelijk abonnement toe en controleer het beleid van je eigen bedrijf.

Drie regels die het waard zijn om te kennen

  • Controleer je privacy-instellingen. ChatGPT, Gemini en de rest hebben een schakelaar in de instellingen die het gebruik van je chats voor training uitschakelt (vaak gebundeld met het opslaan van je geschiedenis). Zoek die — en zet hem uit voor werktaken.
  • Gebruik voor werkgegevens zakelijke abonnementen. Bij bedrijfs- en teamabonnementen (Business/Enterprise) beloven bedrijven over het algemeen niet om je gegevens voor training te gebruiken. Als je iets gevoeligs verwerkt, is dat geen luxe, maar de basis.
  • Als je bedrijf een beleid heeft, is dat leidend. Veel werkgevers hebben al vastgelegd wat wel en niet in AI mag. Niet zeker? Vraag het voordat je een werkdocument plakt.

Een simpele dagelijkse regel

Voordat je op verzenden drukt, stel jezelf één vraag: "Zou ik het prettig vinden als een vreemde deze tekst zag?" Zo ja, plak het dan. Als je een sprankje twijfel voelt, de-identificeer het dan eerst of schakel over naar een tool met een zakelijk abonnement. Die filter van drie seconden beschermt je beter dan welke technische maatregel dan ook — omdat de beslissing plaatsvindt voordat je verzendt, niet na een lek.

Doe dit nu

Neem een willekeurige echte werktekst — een e-mail, een sollicitatie, een deel van een rapport — en oefen met de-identificatie, direct op papier of in je notities. Loop het door en vind alles wat als persoonlijk of commercieel telt: namen, telefoonnummers, adressen, bedrijfsnamen, contractbedragen. Vervang elk door een plaatsaanduiding — "Klant A", "Bedrijf B", "bedrag N". Vergelijk de twee versies: de gede-identificeerde versie legt de inhoud net zo duidelijk uit, maar geeft niets weg. Doe dit één keer bewust en vanaf dan zal je hand de tekst automatisch opschonen voordat je hem ergens naartoe stuurt.

Practice · 3 задачи

Short questions on the lesson — with an explanation for every answer.