
Hoe open en Europese taalmodellen bijdragen aan een digitaal onafhankelijke overheid
Generatieve AI beidt de Nederlandse overheid nieuwe kansen. Bijvoorbeeld om de dienstverlening voor burgers en bedrijven te verbeteren en eigen taken efficiënter uit te voeren. Geopolitieke ontwikkelingen maken duidelijk dat het belangrijk is om kritisch te kijken naar digitale afhankelijkheden. Bij het versterken van digitale soevereiniteit van de Nederlandse overheid is het stimuleren van het gebruik van open source modellen en Europese alternatieven cruciaal.
Begrippen als ‘open source’, ‘open AI' en ‘Europees’ zijn echter niet eenduidig als we het hebben over AI en kunnen op verschillende manieren worden geïnterpreteerd. Aanbieders kunnen veelal zelf bepalen hoe zij hun taalmodellen kwalificeren. Dit schept onduidelijkheid voor gebruikers.
Rapport: Open en Europese taalmodellen
In het nieuwe TNO-rapport ‘Open en Europese taalmodellen bij de overheid – definities en afwegingen’ verkennen onderzoekers op welke manier concepten als ’open’, ’open AI’ en ’Europees’ kunnen worden gedefinieerd. Ze formuleren daarnaast criteria om een afweging te maken rond de inzet van het gebruik van verschillende AI-modellen binnen de Nederlandse overheid.
Wat is een open taalmodel?
De term ‘open’ is het onderwerp van groeiende discussie onder AI‑ontwikkelaars, onderzoekers en beleidsmakers. De termen ‘open’ en ‘open source’ worden regelmatig door elkaar gebruikt. Waar open source in de softwarewereld een relatief vaste betekenis heeft, heeft de term in de context van AI ook een juridische dimensie onder de AI Act.
De AI Act erkent de waarde van open source als bron van innovatie en biedt ‘free and open source’ (FOS) AI‑modellen voor algemene doeleinden en AI-systemen onder bepaalde voorwaarden een uitzonderingspositie.
‘Open’ wordt steeds vaker omschreven als een moving target: een begrip dat voortdurend verschuift en lastig eenduidig te definiëren valt. LLM-ontwikkelaars veroorzaken regelmatig ‘open washing’: punten binnenslepen die openheid aangeven, zonder echt belangrijke informatie te ontsluiten die wetenschappelijk onderzoek en juridische toetsing mogelijk maken.
Om meer duidelijkheid te scheppen in wat ‘openheid’ betekent in de context van AI zijn verschillende raamwerken uitgewerkt. Gebaseerd op de Model Openness Framework (MOF) en de European Open Source AI index (EOSAI), kan men openheid van LLM's indelen in 5 gradaties waarvan closed source, open weight en fully open source de drie meest voorkomende zijn.
Hoe 'open' kan een taalmodel zijn?
| Closed Source | Open Code | Open Weights | Open Research | Fully Open Source |
|---|---|---|---|---|
|
|
|
|
|
|
GPT-5, Claude Opus, Gemini 3.1 |
Phi-4 |
Llama 4, Gemma 3, Mistral 7B | DeepSeek R1, EuroLLm | OLMo, Apertus, BLOOMZ |
Gebaseerd op: European Open-Source AI Index (Liesenfeld & Dingemanse, 2024) en The Model Openness Framework. De categorieën Closed Source en Open Weights komen in de praktijk het vaakst voor.
Wanneer is een taalmodel Europees?
Wanneer je een taalmodel als Europees kunt beschouwen, is minder eenduidig dan vaak wordt aangenomen. Het land van herkomst van de ontwikkelaar is een belangrijke eerste indicator, maar vertelt niet het hele verhaal.
Om elementen als technologische soevereiniteit en publieke waarden mee te nemen in de afweging, is een bredere definitie nodig dan alleen land van herkomst. Een AI‑model kan op basis van drie onderling verbonden dimensies als Europees worden beschouwd.
1. Herkomst en governance van de ontwikkelaar(s)
Het model is ontwikkeld, beheerd of substantieel aangestuurd door een organisatie die binnen Europa is gevestigd en onder Europees recht valt.
2. Datasoevereiniteit en infrastructuur
De herkomst, opslag en verwerking van de (pre)trainingsdata moeten voldoen aan alle geldende EU-wet- en regelgeving. Met het oog op datasoevereiniteit worden datasets idealiter grotendeels binnen Europa verzameld of beheerd, en draait het model op Europese infrastructuur of bij gecertificeerde aanbieders die aan EU‑regels voldoen.
3. Training op Europese talen en waarden en ontwikkelingskeuzes
Trainingsdata in Europese talen bepalen niet alleen de taalkundige vaardigheden van een model, maar kunnen ook de culturele waarden die in die talen besloten liggen meenemen.
Afwegingen voor open en Europese taalmodellen
Het inzetten van taalmodellen vraagt om het maken van verantwoorde keuzes. In het rapport presenteren we een overzicht van relevante dimensies bij het kiezen en inzetten van taalmodellen, gegroepeerd naar vier categorieën: openheid, Europese elementen, technische specificaties en gebruik.
Dit overzicht dient als hulpmiddel om inzicht te krijgen in de factoren die van belang zijn bij de keuze voor een taalmodel, op basis van de mate waarin het model open of Europees is.
| Overweging | Openheid | Europese elementen | Technische specificaties | Gebruik |
|---|---|---|---|---|
|
|
|
|
|








