TL;DR
- Wat: xAI lanceerde op 12 augustus Grok 4.6 — een AI-model dat qua benchmarks gelijkstaat aan GPT-5.6 Sol, tegen de helft van de prijs.
- Waarom relevant: het model is (nog) niet beschikbaar in de EU, wat Nederlandse ondernemers beperkt in hun keuze voor AI-tooling.
- Wat je ermee kunt: houd in de gaten wanneer EU-toegang komt en vergelijk ondertussen alternatieven die wél beschikbaar zijn.
Elon Musk postte deze week een enthousiaste reactie over Grok 4.6, het nieuwste AI-model van zijn bedrijf xAI. Ik vond het een goed moment om uit te zoeken wat dit model precies biedt — en vooral: wat het betekent als je in Nederland een bedrijf runt.
Wat is Grok 4.6 precies?
Grok 4.6 is het opvolgermodel van Grok 4.5 en werd op 12 augustus gelanceerd, slechts 35 dagen na zijn voorganger. Het is een groot taalmodel — vergelijkbaar met ChatGPT of Claude — dat tekst en afbeeldingen kan verwerken en tekst teruggeeft.
Een paar kerncijfers:
- Contextvenster: 500.000 tokens (dat is ruwweg het equivalent van een boek van 375 pagina's dat het model in één keer kan "lezen")
- Prijsstelling: $2 per miljoen invoertokens, $6 per miljoen uitvoertokens
- Redeneersnelheid: 65,5 tokens per seconde
- Nieuw redeneerniveau: naast 'low' en 'high' is er nu een 'xhigh'-modus voor complexere taken
Wat mij opvalt is de snelheid van ontwikkeling. 35 dagen tussen twee versies — dat is een tempo dat je niet vaak ziet bij dit soort modellen.
Hoe scoort het ten opzichte van de concurrentie?
Hier wordt het interessant. Op de Artificial Analysis Intelligence Index — een samengestelde score van negen benchmarks — scoort Grok 4.6 een 61. Ter vergelijking:
| Model | Score |
|---|---|
| Claude Opus 5 | 63,05 |
| Claude Fable 5 | 62,07 |
| GPT-5.6 Sol Max | 60,93 |
| Grok 4.6 | 60,92 |
Grok 4.6 staat dus vrijwel gelijk met GPT-5.6 Sol Max — het verschil is 0,01 punt. Dat is verwaarloosbaar. Tegelijkertijd scoort het merkbaar lager dan de Claude-modellen van Anthropic.
Waar het wél uitblinkt
Op het gebied van softwareontwikkeling haalt Grok 4.6 95,6% op SWE-bench, wat een sterke score is. En bij zogenaamde "agent-taken" — langlopende opdrachten waarbij het model meerdere stappen zelfstandig uitvoert — is het opvallend efficiënt. Het had ongeveer de helft van het aantal stappen nodig vergeleken met Claude Opus 5 om dezelfde taken af te ronden. Dat scheelt direct in de kosten.
Waar het achterblijft
Maar er zitten ook regressies in. Op SkillsBench daalde de score van 66 naar 56 ten opzichte van Grok 4.5, en de tijd tot het eerste antwoord ging van 8,7 naar 31,2 seconden. Dat is een flinke vertraging. Voor toepassingen waar snelle reacties tellen — denk aan klantenservice of interactieve tools — is dat relevant.
De prijs is interessant, maar er zit een addertje onder het gras
De basisprijs van $2/$6 per miljoen tokens klinkt aantrekkelijk. xAI positioneert Grok 4.6 als "frontier-kwaliteit voor de helft van de prijs". Dat klopt op papier.
Maar in de praktijk meet Artificial Analysis de werkelijke kosten per voltooide taak op $0,84 voor Grok 4.6 tegenover $0,36 voor Grok 4.5. Dat is een verdubbeling. De reden: het model genereert gemiddeld 47% meer uitvoertokens per taak en de cacheprijs is met 67% gestegen.
Ik vind dit een belangrijk punt. Als ondernemer kijk je niet naar de prijs per token — je kijkt naar wat het kost om een taak af te ronden. Stel dat je Grok inzet voor het automatisch verwerken van offerteaanvragen of het samenvatten van contracten. Dan is die stijging van $0,36 naar $0,84 per taak iets om mee te rekenen, zeker bij volume.
Het grote probleem voor Nederlandse ondernemers
En dan het punt dat ik het meest relevant vind voor lezers in Nederland: Grok 4.6 is niet beschikbaar in de EU.
De API draait alleen op servers in de VS (us-east-1 en us-west-2). Er is geen EU-regio beschikbaar. De voorganger, Grok 4.5, werd door de Europese Commissie geclassificeerd als een "systemisch risico" onder de AI Act — de Europese AI-wetgeving die eisen stelt aan modellen boven een bepaalde trainingsomvang. Dat betekent dat xAI uitgebreide veiligheidsbeoordelingen en cybersecuritytests moet doorlopen voordat het model in Europa aangeboden mag worden.
Grok 4.5 kreeg in juli 2026 uiteindelijk wél API-toegang in de EU. Of en wanneer dat voor Grok 4.6 gebeurt, is op dit moment niet bevestigd.
Kun je je voorstellen wat dit betekent als je net je AI-workflow hebt ingericht op een model dat vervolgens niet in jouw regio beschikbaar is? Dit is wat mij betreft een onderbelicht risico bij het kiezen van AI-tooling: regionale beschikbaarheid is geen bijzaak.
Wat betekent dit praktisch?
Als je als Nederlandse ondernemer kijkt naar AI-modellen voor je bedrijfsprocessen, dan is het landschap op dit moment als volgt:
- Grok 4.6 biedt sterke prestaties voor de prijs, maar is niet beschikbaar in de EU en heeft hogere werkelijke kosten per taak dan de vorige versie.
- Claude Opus 5 en Claude Fable 5 scoren hoger op de benchmarks en zijn wél beschikbaar in Europa.
- GPT-5.6 Sol presteert nagenoeg gelijk aan Grok 4.6 en is eveneens in de EU toegankelijk.
- Meta's Muse Spark 1.2 biedt volgens Artificial Analysis vergelijkbare prestaties met een groter contextvenster én lagere kosten.
Ik denk dat de modelkeuze voor Europese ondernemers op dit moment minder een kwestie is van "welk model is het beste" en meer van "welk model kan ik überhaupt gebruiken, tegen welke kosten, en met welke garanties over beschikbaarheid".
Een korte observatie
Wat mij bij dit verhaal het meest bezighoudt, is niet zozeer Grok 4.6 zelf — het is een sterk model, geen twijfel. Het is het patroon dat zich aftekent: de snelheid waarmee nieuwe modellen verschijnen, de complexiteit van prijsstructuren die op papier goedkoop lijken maar in de praktijk duurder uitvallen, en de regulatoire barrières die bepalen of je als Europees bedrijf überhaupt mee kunt doen.
Voor mij is dit vooral een signaal dat het kiezen van AI-tooling steeds meer lijkt op het kiezen van een zakelijke partner: je kijkt niet alleen naar wat het kan, maar ook naar of het er is wanneer je het nodig hebt.
80% van de AI-projecten haalt productie nooit.
Ik bouw de 20% — van prototype naar draaiend systeem, binnen weken.