Overslaan en naar de inhoud gaan

Grip op DDAS-data: hoe het CBS kwaliteit én privacy garandeert

Nicolle Aelmans en Maico Hoksbergen

Pas als cijfers aantoonbaar kloppen én de privacy van inwoners geborgd is, gaat het CBS over tot publicatie. Maar hoe ziet dat proces er in de praktijk uit? Binnen het project Data Delen Armoede en Schulden (DDAS) roept dit bij gemeenten en softwareleveranciers terugkerende vragen op. Nicolle Aelmans (directeur Statistieken Arbeid, Inkomen en Leefsituatie CBS en lid van de DDAS-stuurgroep) en Maico Hoksbergen (senior beleidsadviseur en privacy-coördinator CBS) geven helderheid. Ze leggen uit hoe gemeenten de regie behouden via op-orde-rapporten en op welke manier BSN-nummers veilig worden omgezet in betekenisloze codes.

Hoe garandeert het CBS dat data pas gepubliceerd worden als een gemeente vindt dat ze kloppen? 

Aelmans: ‘We merken dat er bij de aanleverende organisaties in deze fase soms twijfels zijn over de kwaliteit van de gegevens die ze aanleveren. Daarom vinden we het belangrijk om daarover eerst goed af te stemmen. Daarvoor maken we elke keer een op-orde-rapport. Daarin staat een samenvatting van de aangeleverde gegevens, ter controle. Dit betreffen alleen anonieme gegevens zoals het totaal aantal aanmeldingen, intakes en oplossingen. Gemeenten kunnen dan zien of hun aanlevering klopt, en zo nodig opnieuw aanleveren. Zo krijgen we samen grip op de kwaliteit van de gegevens.

In dit stadium vragen we expliciet akkoord op het op-orde-rapport. Pas daarna kunnen de data gebruikt worden voor publicatie. De ervaring leert dat er later meer routine komt in de aanleveringen en daarmee meer vertrouwen in de kwaliteit van aangeleverde data. Dit soort rapportages zijn dan niet meer nodig. Tegen die tijd zullen we de stap van actief akkoord vragen weglaten. Daar is het nu nog te vroeg voor.’

Is DDAS het eerste project met lokale data?

Aelmans: ‘Nee hoor, bij het CBS verzamelen we al veel gegevens van gemeenten (soms) op BSN-niveau, net als bij DDAS. Bijvoorbeeld voor de monitor sociaal domein, de monitor dakloosheid en de monitor laaggeletterdheid. Ook bij deze projecten was er een relatief lange opstartfase voordat er voldoende goede gegevens waren om te kunnen publiceren. Als alles eenmaal goed is ingericht en het proces goed loopt, scheelt het gemeenten juist werk.

We zijn ons ervan bewust dat we bij DDAS in eerste instantie veel handelingen van gemeenten vragen. Om de datastroom naar het CBS efficiënter te laten verlopen is er nu ook gegevensuitwisseling mogelijk via een API, een digitale schakel die ervoor zorgt dat softwaretoepassingen data veilig en relatief eenvoudig met elkaar data kunnen uitwisselen. Dat is een innovatie die we bij DDAS introduceren.’

Hoe ziet het tijdspad van publiceren eruit?

Aelmans: ‘Als de kwaliteit van aangeleverde gegevens dat toelaat, willen we eind 2026 publiceren over cijfers van ondernemers. Denk daarbij dan aan het aantal trajecten in de schuldhulpverlening naar achtergrondkenmerken van hulpvragers, zoals geslacht, leeftijd en inkomensklassen. Die achtergrondkenmerken halen we uit bestaande registraties van overheden en bedrijven die het CBS al beschikbaar heeft voor statistisch onderzoek. Zo hoeven we bij gemeenten minder gegevens uit te vragen.

We hopen natuurlijk ook cijfers te kunnen publiceren over populaties van burgers. Dat kan zoals gezegd pas als een gemeente akkoord heeft gegeven op de geleverde data, na de check van het op-orde-rapport. Zodra we kwalitatief goede data ontvangen, willen we in 2027 publiceren over de in- en uitstroom van schuldhulptrajecten, de gekozen oplossingen en eventueel de doorlooptijden. In een nog later stadium worden ook begeleiding en nazorg in de schuldhulpverlening opgenomen in de publicaties.

Uiteindelijk willen we zowel per gemeente als voor Nederland totaal een juist beeld geven hoe de schuldhulpverlening eruitziet. Dat kan gebruikt worden voor landelijk en lokaal beleid. Het kan gemeenten helpen in hun taak om te voorkomen dat inwoners problematische schulden krijgen. Gemeenten krijgen scherper zicht op de effectiviteit van schuldhulp en vroegsignalering.’

Hoe zorgt het CBS ervoor dat DDAS de privacy van inwoners waarborgt?

Hoksbergen: ‘We merken dat gemeenten zich afvragen of het wel veilig is om data aan te leveren. Dat begrijpen we, ook omdat gemeenten nu ook gegevens zoals het BSN aan ons moeten leveren. Die hebben we nodig om de aangeleverde gegevens te kunnen koppelen aan de gegevens die wij beschikbaar hebben uit registers. Zo kunnen we dan op macroniveau naar achtergrondkenmerken publiceren.  

Belangrijk om te vermelden is dat de gegevens die bij het CBS binnenkomen zo vroeg mogelijk in het proces worden ontdaan van direct identificerende kenmerken. Een klein team van het CBS zorgt dat burgerservicenummer (BSN), naam, adres en geboortedatum en geslacht worden vervangen door betekenisloze nummers. We noemen dat pseudonimiseren.

Het CBS houdt zich aan de Algemene verordening gegevensbescherming (AVG). Deze wet helpt de privacy van burgers te beschermen. Daarnaast houdt het CBS zich aan de privacybepalingen in de wet CBS. Zo mag het CBS op basis van de wet CBS geen persoonsgegevens aan derden verstrekken.

CBS publiceert verder nooit gegevens op een niveau dat er te herleiden is naar een individu. We voorkomen ook dat een combinatie van gepubliceerde gegevens zou kunnen leiden tot onthulling van personen, huishoudens, ondernemingen of instellingen. Bij mogelijke onthullingsrisico’s treffen we maatregelen zoals het samenvoegen van publicatiecellen (aggregeren) of het verwijderen van celwaarden (onderdrukken). Daarvoor heeft het CBS in Europees verband software ontwikkeld. Alle output wordt daarna ook nog volgens het vier-ogen-principe gecontroleerd voordat het daadwerkelijk wordt gepubliceerd. Dit gehele proces noemen we statistische beveiliging. Zie hiervoor ook ons gepubliceerde handboek.’

Hoe gaat een DDAS-publicatie eruitzien?

Aelmans: ‘Zo’n publicatie bestaat uit tabellen per gemeente en voor heel Nederland. Per gemeente kan dat, zoals Maico al zei, alleen als er voldoende cijfers zijn. De data willen we publiceren in onze databank Statline, of via een dashboard. Bij de publicatie van de eerste tabellen willen we er ook aandacht aan geven in een nieuwsbericht.’

Wat doet het CBS na publicatie met de brondata en bewerkte data?

Hoksbergen: ‘Het CBS bewaart gegevens niet langer dan noodzakelijk is voor zijn wettelijke taak. Voor het bewaartermijnenbeleid conformeert het CBS zich vanzelfsprekend aan de AVG en aan de Archiefwet. Dit betekent concreet dat de oorspronkelijke brondata maximaal 2,5 jaar bewaard blijven en daarna worden verwijderd.

De nette gepseudonimiseerde gegevens worden langer bewaard, voor eigen statistische analyses. Zo kan het nodig zijn om individuele gegevens na enige tijd opnieuw te aggregeren om het heden met het verleden te kunnen vergelijken. Onder bepaalde voorwaarden kunnen ook externe onderzoekers deze gepseudonimiseerde gegevens gebruiken voor statistisch onderzoek. De Wet CBS verbiedt het gebruik van gegevens voor andere doeleinden dan wetenschappelijk of statistisch onderzoek. We toetsen elke 3 jaar of er nog steeds een motivering is voor het bewaren van de gegevens voor hergebruik.’