Artikelen Productnieuws

Open taalmodellen draaien nu ook in Nederland

Samen met Nebul draaien we grote open taalmodellen volledig in Nederland. Voor het eerst kan daarmee ieder onderdeel van vragen.ai op Nederlandse bodem draaien: de applicatie, de kennisbank en het taalmodel. Waarom dat er nu toe doet, en tien vragen met antwoord.

Bing van Moorsel Co-founder, CEO

10 min leestijd

Stel een vraag aan een AI-assistent en er gebeurt iets wat je niet ziet. Je vraag reist naar een datacenter, een taalmodel rekent er een antwoord uit en dat antwoord reist terug. Waar dat datacenter staat en wie er over dat model gaat, daar denken de meeste organisaties pas over na als iemand ernaar vraagt.

Die vraag komt nu van alle kanten. Bestuurders, functionarissen gegevensbescherming en inkopers willen weten van wie hun digitale werk afhankelijk is. Niet zonder reden: de NOS onderzocht begin dit jaar 16.500 domeinnamen van Nederlandse overheden, zorginstellingen, scholen en vitale bedrijven, en 67 procent bleek aan minstens één Amerikaanse clouddienst te hangen, bijna de helft aan Microsoft alleen al. Zelden heeft iemand dat zo gekozen.

Voor vragen.ai hebben we daar vanaf nu een nieuw antwoord op. Samen met Nebul draaien we grote open taalmodellen volledig in Nederland. Voor het eerst kan daarmee ieder onderdeel van vragen.ai op Nederlandse bodem draaien: de applicatie, de kennisbank en het taalmodel dat het antwoord schrijft.

Daarmee lossen we een belofte in waar we al langer aan werken.

“Ik wil heel graag een rol vervullen om soevereine AI, dus AI van Nederlandse bodem, te kunnen aanbieden. Waarbij je van A tot Z zelf gaat over het antwoord dat uit een chatbot komt.”

Matthias, oprichter vragen.ai en eigenaar SWIS

Dat kon lange tijd alleen door kwaliteit in te leveren. Dat is veranderd, en daarom is dit het moment.

Twee derde van Nederland leunt op Amerikaanse cloud

Digitale afhankelijkheid was jarenlang een onderwerp voor beleidsstukken. In mei 2025 kreeg het een gezicht: de hoofdaanklager van het Internationaal Strafhof in Den Haag verloor na Amerikaanse sancties de toegang tot zijn Microsoft-mailbox en stapte over op een Zwitserse dienst. Over wie daar precies de stekker eruit trok verschillen de lezingen, maar de les bleef hangen: wie op een Amerikaanse dienst werkt, kan die dienst ook kwijtraken.

De verhoudingen erachter zijn niet klein. Amazon, Microsoft en Google hebben samen ongeveer 70 procent van de Europese cloudmarkt in handen; alle Europese aanbieders samen komen op 15 procent, tegen 29 procent in 2017. De Tweede Kamer wil inmiddels dat de overheid haast maakt met Nederlandse alternatieven.

Voor de bezoeker van jouw website is dit allemaal onzichtbaar. Voor de mensen die in jouw organisatie over gegevens gaan niet. Zij stellen precies de vraag waar dit artikel over gaat: waar draait het, en wie gaat erover?

Waar een model draait en wie erover gaat

vragen.ai is vanaf het begin taalmodel-onafhankelijk gebouwd. Per agent kies je welk model het gesprek voert, en bij ieder model staat een label: NL, EU of US. Sinds deze zomer zijn er daarmee drie smaken.

Waar het model draait Voorbeelden Wie gaat over het model Wat je vraag beantwoordt
Nederland, bij Nebul open modellen zoals Kimi, Qwen, GLM en Mistral wijzelf: we draaien een eigen versie onze eigen infrastructuur in Nederland
EU, bij Microsoft de meeste GPT-modellen OpenAI een dienst van Microsoft in een Europees datacenter
Verenigde Staten Claude en enkele GPT-varianten Anthropic en OpenAI een dienst van de aanbieder in de Verenigde Staten

De GPT-modellen gebruiken we via Microsoft in Europese datacenters. De verwerking blijft daarmee binnen Europa, met afspraken over gegevensverwerking en zonder training op jouw data. Maar het model blijft een dienst: de maker bepaalt welke versies er zijn en wanneer een versie verdwijnt.

Bij de modellen bij Nebul ligt dat anders. Wij beschikken zelf over de versie die we draaien. Voor het beantwoorden van een vraag is geen verbinding met de maker nodig: er gaat geen vraag naar buiten en de maker ziet geen gesprek. Stopt de maker ooit met een model, dan verdwijnt onze versie niet. Overstappen wordt een keuze die we zelf plannen en testen.

GPT en Claude blijven gewoon beschikbaar. De Nederlandse modellen komen erbij, zodat je per toepassing kunt afwegen wat past.

De beste open modellen doen mee met de top

Lang was de afweging simpel: wilde je het beste model, dan kwam je bij de grote Amerikaanse aanbieders uit. Dat is voorbij, en dat is geen gevoel maar meetwerk (stand: augustus 2026).

Het onafhankelijke meetbureau Artificial Analysis zet de nieuwste versie van Kimi, een open model van het Chinese Moonshot AI, op de eerste plaats van ruim honderd gemeten open modellen. Bij verschijnen deze zomer stond datzelfde model wereldwijd op de derde plaats, open en gesloten samen, vergelijkbaar met de topmodellen van OpenAI en Anthropic van dat moment. Onderzoeksinstituut Epoch AI becijferde dit voorjaar dat de beste open modellen gemiddeld vier maanden achterlopen op de gesloten top.

Vier maanden. Dat is de hele afstand. En in ons eigen testwerk, vragen beantwoorden uit een kennisbank met bronvermelding, is die afstand zelden wat het antwoord beter of slechter maakt; de kwaliteit van de bron weegt zwaarder.

Welke modellen er op dit moment in vragen.ai staan en hoe ze scoren op slimheid en snelheid, zie je in de modelkiezer in het product. Nieuwe versies volgen elkaar per maand op, dus die lijst verandert sneller dan een artikel kan bijhouden. Daarom noemen we hier bewust geen versienummers: de actuele stand woont in het product, dit artikel legt uit hoe je kiest.

“Maar het zijn Chinese modellen”

Kimi komt van Moonshot AI uit China, Qwen van Alibaba en GLM van het Chinese Zhipu AI. Dat roept logischerwijs vragen op.

Daarom is het onderscheid tussen herkomst en verwerking zo belangrijk. Het modelbestand staat bij Nebul in Nederland. Voor het beantwoorden van een vraag is geen verbinding met Moonshot, Alibaba of Zhipu nodig. Er gaat geen vraag naar China en de maker ontvangt geen inhoud van het gesprek. Stelt een inwoner van een gemeente een vraag die door Kimi wordt beantwoord, dan blijft die verwerking dus in Nederland.

De herkomst verdwijnt daarmee niet. Het model is in China ontwikkeld en getraind, en wij waren daar niet bij. Maar voor het dagelijks gebruik zijn we van de maker niet afhankelijk. Dat onderscheid vinden we relevanter dan het land achter de naam.

Nebul kan wat in Europa maar een handvol partijen kan

Nebul is een Nederlands AI-cloudbedrijf uit Leiden, dezelfde stad als SWIS, het bureau achter vragen.ai. Het bouwt sinds 2022 aan rekenclusters op NVIDIA-hardware in Nederlandse datacenters. Onderzoeksbureau Gartner zette Nebul in 2025 op zijn wereldwijde lijst van Cool Vendors onder de gespecialiseerde AI-cloudaanbieders, en softwarebedrijf Centric koos Nebul dit voorjaar als basis voor AI-diensten aan de Nederlandse overheid.

Dat zo weinig partijen dit kunnen, heeft een nuchtere reden: formaat. Het modelbestand van een groot open model is ruim een terabyte. Om er vlot antwoorden uit te krijgen moet dat bestand verdeeld worden over tientallen gespecialiseerde chips die als één machine samenwerken; een gedocumenteerde productie-opstelling voor de nieuwste Kimi gebruikt er zestien met samen ruim twee terabyte werkgeheugen. Zulke machines zijn schaars en in Nederland vrijwel nergens als dienst beschikbaar.

In Europa is het aantal aanbieders dat modellen van dit formaat serveert op één hand te tellen. In Nederland vonden we er welgeteld één die het op Nederlandse bodem doet. Kijk daarbij goed naar het verschil tussen een Nederlands hoofdkantoor en Nederlandse servers: er zijn aanbieders met een adres in Amsterdam waarvan de GPU’s in Finland staan.

Twee partijen in de Nederlandse keten

Voor de modellen die in Nederland draaien is de operationele keten kort. De applicatie en de kennisbank staan bij TrueFullstaq in Amsterdam, onze hostingpartner sinds 2013. Het taalmodel draait bij Nebul. Jij bent verwerkingsverantwoordelijke voor de gegevens van je bezoekers; wij zijn je verwerker.

Een vraag gaat naar het model, het model rekent het antwoord uit en stuurt het terug. Nebul slaat de inhoud niet op, logt die niet en gebruikt die niet voor training.

Binnen vragen.ai bewaren we het gesprek wél, zodat jij als redacteur kunt teruglezen wat bezoekers vragen en waar je content tekortschiet. Typt iemand persoonsgegevens in een vraag, dan filteren we die er binnen een uur uit. Gesprekken bewaren we standaard twaalf maanden; die termijn kun je verkorten.

Op onze pagina over privacy, certificeringen en hosting staat uitgebreider welke gegevens we verwerken en welke partijen daarbij betrokken zijn.

Soevereiniteit is geen absoluut begrip

Dat een taalmodel in Nederland draait, betekent niet dat de hele technologie Nederlands is. De hardware bevat technologie uit onder meer de Verenigde Staten en Taiwan. Kimi, Qwen en GLM zijn ontwikkeld en getraind in China, Mistral in Frankrijk. We waren niet betrokken bij hun trainingsdata of trainingsproces.

Ook qua kwaliteit is er geen model dat voor iedere situatie het beste is. Voor sommige taken presteren de zwaarste gesloten modellen beter. In andere gevallen bieden de modellen in Nederland vergelijkbare kwaliteit, met een andere inrichting van de keten.

Daarom vervangen we niets. We voegen mogelijkheden toe en maken zichtbaar waar ieder model draait, zodat jij per toepassing kunt bepalen welke combinatie past bij je eigen kennisbank en je eigen bezoekers.

Tien vragen die we hierover krijgen

Dit zijn de vragen die in gesprekken over dit onderwerp het vaakst terugkomen. Korte antwoorden; de details staan hierboven en op de veiligheidspagina.

1. Waar wordt de vraag van een bezoeker verwerkt?

Altijd bij vragen.ai in Amsterdam, waar de applicatie en jouw kennisbank staan. Het taalmodel kies je per agent: in Nederland, in de EU of in de Verenigde Staten. Het label bij ieder model zegt waar het draait.

2. Kan de Amerikaanse overheid bij gegevens die bij een Amerikaans bedrijf staan, ook op Europese servers?

Amerikaanse wetgeving kan Amerikaanse bedrijven verplichten om gegevens te verstrekken, ook als die op servers in Europa staan. Hoe vaak dat gebeurt weet niemand precies; dat het kan, staat in de wet. Kies je een model dat in Nederland draait, dan zit er in dat deel van de keten geen Amerikaans bedrijf.

3. GPT draait via Microsoft in Europa. Is dat niet genoeg?

Voor veel toepassingen wel: de verwerking blijft binnen Europa en er wordt niet op jouw data getraind. Maar het model blijft een dienst van een Amerikaans bedrijf, onder Amerikaanse wetgeving, en de maker bepaalt welke versies er zijn. Daarom is het bij vragen.ai een keuze per agent en geen alles-of-niets.

4. Zijn open modellen net zo goed als GPT of Claude?

De beste open modellen staan op het niveau van de gesloten top van ongeveer vier maanden geleden. Voor het beantwoorden van vragen uit een kennisbank met bronvermelding doen ze in ons testwerk volwaardig mee. De actuele scores per model staan in het product.

5. Sommige open modellen komen uit China. Gaan onze gegevens naar China?

Nee. Het model draait bij Nebul in Nederland en heeft voor een antwoord geen verbinding met de maker nodig. Er gaat geen vraag naar China en de maker ziet geen gesprekken.

6. Wat betekent “open” bij een taalmodel?

De maker publiceert het getrainde modelbestand, zodat anderen het zelf kunnen draaien. De trainingsdata en het trainingsproces krijg je er meestal niet bij; daarom heet dit ook wel “open weights”. Het gevolg telt: wij draaien onze eigen versie en hoeven de maker nergens voor aan te roepen.

7. Wat gebeurt er als de maker van een model stopt?

Bij een gesloten model bepaalt de aanbieder wanneer een versie verdwijnt, en test jij opnieuw. De versie die bij Nebul draait verdwijnt niet. Overstappen op een nieuwe versie wordt een geplande keuze, met testtijd.

8. Wie kan er meelezen met gesprekken?

Bij een model in Nederland bestaat de keten uit vragen.ai en Nebul, en Nebul slaat de inhoud niet op en logt die niet. Jij leest als beheerder gesprekken terug in je eigen omgeving; persoonsgegevens filteren we er binnen een uur uit.

9. Wordt er getraind op de vragen van onze bezoekers?

Nee. Niet door ons, niet door Nebul en ook niet door de makers van de gesloten modellen; daarover zijn afspraken vastgelegd. Bij de modellen in Nederland kan het bovendien niet: de maker ziet de gesprekken niet.

10. Is vragen.ai hiermee honderd procent soeverein?

Nee, en wees voorzichtig met iedere partij die dat wel belooft. De hardware bevat Amerikaanse en Taiwanese technologie en de modellen zijn elders getraind. Wat nu wél in Nederland ligt: waar het model draait, welke versie we gebruiken en wie er nodig is om een vraag te beantwoorden.

Verder lezen

Heb je een vraag die er niet tussen staat? Stel hem dan.