Open data over de ANBI-sector
Wij bezoeken de website van elke ANBI-geregistreerde organisatie in Nederland — ruim 55.000 — en leiden daaruit cijfers af die verder nergens bestaan. Die cijfers staan hieronder als downloadbare bestanden, onder CC BY 4.0: te gebruiken waarvoor je wilt, ook commercieel, mits je NuttigWerk als bron noemt.
Wij publiceren tellingen, geen conclusies. Waar je een percentage zou verwachten staan de teller en de noemer, zodat je zelf kunt rekenen met de onzekerheid die bij jouw vraag past. Dat is niet uit bescheidenheid: wij toonden eerder wél een rangschikking van thuiswerk per sector, en die bleek ruis — de bovenste sector was één vacature op dertien.
Let bij elke uitsplitsing op de categorieën overig, onbekend en unknown. Die zijn hier groot: 45,4% van de organisaties heeft geen bruikbare sector, en 44,5% van de vacatures geen bepaald dienstverband. Elke dataset draagt daarom een kanttekening, en die zit ook in de JSON-respons zelf.
Wij publiceren afgeleide cijfers, geen ruwe teksten. Het ANBI-register is open data van de Belastingdienst, maar de vacatureteksten zijn van de organisaties die ze schreven, en persoonsgegevens staan er niet in. Laatst herberekend op 5 september 2026.
De volledige dataset
Dit is de set zelf, niet onze samenvatting ervan. Haal hem in zijn geheel op als CSV, of vraag een gefilterd stuk op als JSON — elke tabel noemt zelf op welke velden je kunt filteren, en je hangt ze als queryparameter aan de URL. Persoonsgegevens en ruwe websiteteksten zitten er niet in; zie de toelichting hierboven.
Alle ANBI-organisaties, verrijkt met onze crawlgegevens
54.076 rijen · 19 kolommenElke organisatie met een ANBI-status in het register van de Belastingdienst, aangevuld met wat wij bij het bezoeken van hun website hebben vastgesteld: of de site antwoordde, in welke sector wij de organisatie plaatsen, of we er thuiswerkmogelijkheden zagen, wanneer we er voor het laatst waren en hoeveel signalen we er vonden. Met coördinaten erbij, zodat de set direct in QGIS, R of een kaartbibliotheek te gebruiken is. Dit is de volledige set, niet een selectie: filter, tel en groepeer hem zoals jouw vraag het vraagt. Persoonsgegevens en ruwe websiteteksten zitten er niet in.
De kolommen sector, is_religious_website en has_remote_options zijn door ons afgeleid en niet door de organisatie zelf opgegeven. Sector is voor 45,4% van de rijen "overig" of leeg. website_status is een momentopname van het laatste bezoek, niet van vandaag. Kijk bij de coördinaten naar geo_precisie, want de twee waarden zijn niet vergelijkbaar. Bij "pand" is het punt het gebouw zelf, gevonden op postcode plus huisnummer uit een adres dat op de eigen website van de organisatie stond, en staat er een BAG-identificatie bij waarmee de rij aan de Basisregistratie Adressen en Gebouwen te koppelen is. Bij "woonplaats" is het het middelpunt van het dorp: alle organisaties in Warnsveld delen dan hetzelfde punt. Beide komen van de PDOK Locatieserver van het Kadaster. Reken dus geen afstanden op rijen met precisie "woonplaats". 688 organisaties zijn buiten Nederland gevestigd en hebben daarom wel een land maar geen provincie; 153 hebben geen van beide. Een plaatsnaam die niet eenduidig op te lossen was blijft leeg in plaats van een gok te krijgen: er zijn drie Beeks en twee Achtervelds, in verschillende provincies.
Filteren op: vestigingsplaats,provincie,land,geo_precisie,sector,website_status,organization_status,is_religious_website,has_remote_options
Bijvoorbeeld: /data/tabel/organisaties.csv?vestigingsplaats=…
Openstaande vacatures die een bezoeker kan openen
1.268 rijen · 16 kolommenElke vacature die op dit moment op NuttigWerk te openen is, met de kenmerken die wij eruit hebben afgeleid: sector en provincie van de organisatie, soort dienstverband, werklocatie, uren per week, genormaliseerde functienaam en opleidingsniveau. Dit is exact dezelfde populatie als het aantal op de voorpagina en in de zoekfunctie -- ontdubbeld, met verlopen sluitingsdata eruit. De vacaturetekst zelf staat er niet in; de URL wijst naar de bron.
Bijna alles in deze tabel is afgeleid door een taalmodel uit de tekst van een webpagina, en de dekking verschilt sterk per kolom: werklocatie is voor 100% bekend, functienaam voor 10,9% en opleidingsniveau voor 5,1%. Een lege cel betekent dat wij het niet konden vaststellen, niet dat het er niet stond. Zie de dataset "dekking" voor alle percentages.
Filteren op: sector,provincie,vestigingsplaats,dienstverband,werklocatie,thuiswerk,functie,functiecategorie,opleidingsniveau,contractvorm
Bijvoorbeeld: /data/tabel/vacatures.csv?sector=…
Alle gevonden signalen, ook wat de triage heeft afgekeurd
65.210 rijen · 13 kolommenElke pagina waarop onze scanner iets vond dat op werk of vrijwilligerswerk lijkt -- inclusief wat wij daarna hebben afgekeurd, gearchiveerd of als duplicaat hebben aangemerkt. Dit is de ruwste laag die wij publiceren en de enige waarin te zien is wat wij weggooien en waarom. Wie wil controleren of onze triage streng of juist te streng is, kijkt hier. De paginatekst zelf staat er niet in; de URL wijst naar de bron.
Dit is werkmateriaal, geen vacaturelijst. Het overgrote deel van deze rijen is geen openstaande vacature: het zijn overzichtspagina's, verlopen advertenties, duplicaten en pagina's die onze triage heeft afgekeurd. Gebruik de dataset "vacatures" als je wilt weten wat er daadwerkelijk openstaat.
Filteren op: paginasoort,inhoudsoort,is_remote,is_vrijwillig,functie,triage,gearchiveerd,archiefreden
Bijvoorbeeld: /data/tabel/signalen.csv?paginasoort=…
Kant-en-klare aggregaten
Voorgerekende tellingen voor wie niet de hele set wil verwerken. Ze zijn afgeleid van de tabellen hierboven, dus je kunt elke regel zelf natrekken.
| Dataset | Rijen | Kolommen | Formaat |
|---|---|---|---|
| ANBI-organisaties, opgegeven websites en bereikbaarheid per provincie | 15 | 5 | CSV · JSON |
| ANBI-organisaties per sector en provincie | 189 | 4 | CSV · JSON |
| Openstaande vacatures per dienstverband en werklocatie | 14 | 3 | CSV · JSON |
| Openstaande vacatures en thuiswerkvacatures per sector | 13 | 3 | CSV · JSON |
| Gevraagde uren per week per dienstverband, in percentielen | 4 | 5 | CSV · JSON |
| Openstaande vacatures per genormaliseerde functienaam | 95 | 4 | CSV · JSON |
| Dekkingsgraad per afgeleid gegeven | 8 | 4 | CSV · JSON |
Machineleesbaar
De catalogus is ook beschikbaar als DCAT, de standaard waarmee open-dataportalen
elkaars aanbod uitlezen. Elke dataset op deze pagina draagt daarnaast schema.org/Dataset-markup,
zodat zoekmachines en AI-assistenten weten wat ze citeren en onder welke voorwaarden.