Sol, Terra, Luna, Fable, Opus, Sonnet, Flash, Scout, Maverick. De namen van AI-modellen zeggen een normale gebruiker weinig, en toch maakt het uit welke je gebruikt: het model bepaalt hoe goed het antwoord is, hoeveel tekst je erin kwijt kunt en wat je ervoor betaalt.
Deze pagina is bedoeld als naslagwerk. Hieronder staan alle modellen die er in augustus 2026 toe doen, gegroepeerd per aanbieder, met de releasedatum, het contextvenster en de prijs per miljoen tokens. Je hoeft ze niet uit je hoofd te kennen. Maar als je ergens een modelnaam tegenkomt, kun je hier opzoeken van wie hij is, waar hij voor bedoeld is en of hij bij jouw werk past.
Model, app en abonnement zijn drie verschillende dingen
De meeste verwarring komt doordat drie dingen door elkaar lopen. Het model is de motor: GPT-5.6 Sol, Claude Sonnet 5, Gemini 3.1 Pro. De app is wat je opent: ChatGPT, Claude, Gemini. Het abonnement bepaalt welke modellen je in die app mag gebruiken en hoe vaak. In één app zitten dus meerdere modellen, en dezelfde modellen zitten vaak ook in andere apps. Welk abonnement welke modellen ontsluit, staat in onze vergelijking van AI-abonnementen.
Vier begrippen kom je in elk overzicht tegen.
Tokens. De rekeneenheid van een taalmodel. Een token is een stukje van een woord; als vuistregel is duizend tokens ongeveer 750 woorden. Aanbieders rekenen per miljoen tokens af, apart voor wat je erin stopt (in) en wat eruit komt (uit).
Contextvenster. Hoeveel tekst het model tegelijk kan overzien: je vraag, het hele gesprek tot dan toe, je bijlagen en het antwoord bij elkaar. Een venster van een miljoen tokens komt neer op enkele duizenden pagina's. Loopt een gesprek eroverheen, dan valt het begin eruit en gaat het model dingen vergeten.
Open weights. Het model is als bestand te downloaden, zodat je het zelf op eigen hardware of bij een eigen hoster kunt draaien. Bij gesloten modellen kan dat niet: die draaien alleen bij de aanbieder zelf. Open weights zeggen iets over vrijheid en privacy, niet automatisch over kwaliteit.
Reasoning. Een modus waarin het model eerst stap voor stap uitwerkt hoe het tot een antwoord komt, voordat het antwoordt. Dat duurt langer en kost meer, maar levert merkbaar betere resultaten bij logica, wiskunde en code. Bij eenvoudige vragen is het zonde van de tijd.
| Model | From | Released | Context | Dutch | Best for |
|---|---|---|---|---|---|
| GPT-5.6 Sol | OpenAI | 9 July 2026 | 1,05M tokens | Good | Heavy analysis, agents and professional work |
| GPT-5.6 Terra | OpenAI | 9 July 2026 | 1,05M tokens | Good | Daily work at a lower price |
| GPT-5.6 Luna | OpenAI | 9 July 2026 | 1,05M tokens | Fair | Quick questions and high volumes |
| Claude Fable 5 | Anthropic | 9 June 2026 | 1M tokens | Excellent | Hard, long-running work where quality beats cost |
| Claude Opus 5 | Anthropic | June 2026 | 1M tokens | Excellent | Complex reasoning tasks and long documents |
| Claude Sonnet 5 | Anthropic | 30 June 2026 | 1M tokens | Excellent | Daily writing, coding and agents |
| Gemini 3.5 Flash | 19 May 2026 | 1,05M tokens | Good | Fast multimodal work and large volumes | |
| Gemini 3.1 Pro | preview | 1M tokens | Good | Research and document analysis | |
| Grok 4.5 | xAI | 8 July 2026 | 500K tokens | Fair | Programming, engineering and current information |
| Mistral Medium 3.5open | Mistral AI | April 2026 | 256K tokens | Good | European deployments and agent work |
| Mistral Small 4open | Mistral AI | March 2026 | 256K tokens | Fair | Cheap instructing, reasoning and coding |
| DeepSeek V4 Proopen | DeepSeek | April 2026 | 1M tokens | Poor | Cheap reasoning and programming |
| Qwen 3.8 Max | Alibaba | 3 August 2026 | 1M tokens | Poor | Multimodal agents and code |
| Llama 4 Scout / Maverickopen | Meta | April 2025 | 10M tokens | Fair | Self-hosting with extremely long context |
| Muse Glimmeropen | Meta | August 2026 | 256K tokens | Poor | Local agents on your own laptop |
OpenAI: GPT-5.6 in drie smaken
OpenAI bracht op 9 juli 2026 één generatie uit in drie formaten. Ze delen hetzelfde contextvenster van 1,05 miljoen tokens en verschillen vooral in hoe zwaar en hoe duur ze zijn.
| Model | Uitgebracht | Contextvenster | API in–uit per miljoen tokens |
|---|---|---|---|
| GPT-5.6 Sol | 9 juli 2026 | 1,05 miljoen | $5 / $30 |
| GPT-5.6 Terra | 9 juli 2026 | 1,05 miljoen | $1,25 / $10 |
| GPT-5.6 Luna | 9 juli 2026 | 1,05 miljoen | $0,10 / $0,80 |
Sol is het vlaggenschip. Sinds de update van 6 augustus 2026 gaat het beter om met feiten en zit er in ChatGPT een effort-schuif waarmee je zelf bepaalt hoe lang het model over een antwoord mag nadenken. Terra is het middensegment en ongeveer even sterk als het vlaggenschip van vorig jaar, GPT-5.5, tegen een fractie van de prijs: op 30 juli 2026 ging er nog 20% af. Luna is de goedkoopste en sinds 6 augustus 2026 het standaardmodel voor gratis gebruikers en voor het Go-abonnement. De prijs van Luna daalde op 30 juli 2026 met 80%.
Dat gratis niveau is inmiddels serieus: onbeperkt tekstchatten op Luna plus een Think-knop voor zwaardere vragen. De limieten zitten nu op uploads, beeld en tools, niet meer op het aantal berichten. Betalen loont vooral als je het topmodel veel gebruikt — Plus geeft 160 berichten per drie uur op het zwaarste model, tegenover historisch tien berichten per vijf uur op het gratis plan.
Voor beeld en video heeft OpenAI GPT Image 2 en Sora 2, allebei inbegrepen in ChatGPT Plus. Dat is het duidelijkste argument om juist bij OpenAI te blijven: geen enkele andere aanbieder stopt videogeneratie in een abonnement van deze prijsklasse.
Anthropic: Claude Fable, Opus en Sonnet
Anthropic hanteert dezelfde driedeling, maar met een eigen accent: alle drie de modellen hebben een contextvenster van een miljoen tokens en de nadruk ligt op tekst, code en betrouwbaarheid.
| Model | Uitgebracht | Contextvenster | API in–uit per miljoen tokens |
|---|---|---|---|
| Claude Fable 5 | 9 juni 2026 | 1 miljoen | $10 / $50 |
| Claude Opus 5 | juni 2026 | 1 miljoen | $5 / $25 |
| Claude Sonnet 5 | 30 juni 2026 | 1 miljoen | $2 / $10 |
Fable 5 is het zwaarste en met afstand het duurste model op de markt. Let op: in de Claude-apps zit Fable 5 niet in het Pro-abonnement, je rekent het af met vooraf gekochte credits. Opus 5 is het redeneermodel voor moeilijke opgaven. Sonnet 5 is het werkpaard voor dagelijks gebruik en tegelijk het model dat je in de gratis versie van Claude krijgt — dat maakt gratis Claude een van de sterkste gratis opties die er zijn.
Wat Claude verder onderscheidt: Claude Pro bevat Claude Code en Claude Cowork, en training op je gesprekken staat op de betaalde consumentenplannen standaard uit. Zet je training wel aan, dan wordt je data langer bewaard. Meer over hoe Anthropic werkt en waarom het model zo goed Nederlands schrijft, lees je in Claude AI uitgelegd.
Google: Gemini 3.5 Flash en 3.1 Pro
Google werkt met twee sporen: een snel, breed inzetbaar model en een zwaarder model voor denkwerk.
| Model | Uitgebracht | Contextvenster | API in–uit per miljoen tokens |
|---|---|---|---|
| Gemini 3.5 Flash | 19 mei 2026 | 1,05 miljoen | $1,50 / $9 |
| Gemini 3.1 Pro | preview | 1 miljoen | $2 / $12 |
Gemini 3.5 Flash is het stabiele werkpaard en multimodaal: het verwerkt tekst, beeld en documenten in hetzelfde gesprek. Gemini 3.1 Pro staat nog als preview en is het zware model in Google AI Plus en Google AI Pro.
De reden dat veel Nederlanders bij Google uitkomen is niet het model maar wat eromheen zit. Google AI Pro (€21,99 per maand) geeft je een contextvenster van een miljoen tokens, Deep Research, NotebookLM en 2 TB opslag. Google AI Plus kost €7,99 en heeft 200 GB opslag. Voor beeld en video heeft Google Nano Banana Pro en Veo 3.1. Hoe dat abonnement in elkaar zit — en waarom je het misschien al hebt zonder het te weten — staat in Gemini AI uitgelegd.
xAI en Mistral: Grok en de Europese optie
Grok 4.5 van xAI verscheen op 8 juli 2026, heeft een contextvenster van 500.000 tokens en kost $2 in en $6 uit per miljoen tokens. Het is sterk in code en het enige model met directe toegang tot live data van X. Het contextvenster is kleiner dan bij de concurrentie, en het abonnement is met €31,53 per maand het duurste standaardplan van de grote aanbieders.
Mistral is de Franse aanbieder en voor Nederlandse gebruikers relevant om een andere reden: de verwerking gebeurt in de EU, in Frankrijk en Zweden. Alle drie de modellen hebben een contextvenster van 256.000 tokens.
| Model | Uitgebracht | Licentie | API in–uit per miljoen tokens |
|---|---|---|---|
| Mistral Medium 3.5 | april 2026 | open weights, aangepaste MIT | $1,50 / $7,50 |
| Mistral Large 3 | december 2025 | Apache 2.0 | $0,50 / $1,50 |
| Mistral Small 4 | maart 2026 | Apache 2.0 | $0,15 / $0,60 |
Medium 3.5 is het model dat je in Le Chat Pro (€15,76 per maand) gebruikt, inclusief een modus zonder telemetrie. Small 4 is multimodaal en zo goedkoop dat het voor eigen toepassingen vaak het verstandigste startpunt is. Eerlijk is eerlijk: op de zwaarste taken halen de Mistral-modellen het niveau van Sol of Opus 5 niet. Je kiest ze om waar je data staat, niet om de topprestatie.
De open modellen: DeepSeek, Qwen, Llama en de rest
Deze groep gebruik je zelden via een consumentenabonnement. Je komt ze tegen als je zelf iets bouwt of iets op eigen hardware wilt draaien. De prijzen hangen dan af van je hoster, niet van de maker.
| Model | Maker | Uitgebracht | Contextvenster | Waar het voor is |
|---|---|---|---|---|
| DeepSeek V4 Pro / Flash | DeepSeek | april 2026 | 1 miljoen | Zeer goedkoop: $0,435 / $0,87 en $0,14 / $0,28 |
| Qwen 3.8 Max | Alibaba | 3 augustus 2026 | 1 miljoen | Nieuwste Alibaba-model, getrapte prijzen |
| Llama 4 Scout / Maverick | Meta | april 2025 | tot 10 miljoen | De standaard voor zelf hosten |
| Muse Glimmer | Meta | augustus 2026 | 256.000 | 30B, Apache 2.0, draait op één consumenten-GPU |
| GLM-5.2 | Z.ai | 16 juni 2026 | 1 miljoen | Open engineeringmodel |
| Kimi K2.7 Code | Moonshot | juni 2026 | 256.000 | Lange runs van codeeragents |
| MiniMax M3 | MiniMax | 1 juni 2026 | tot 1 miljoen | Efficiënt multimodaal, $0,30 / $1,20 |
Twee opmerkingen hierbij. Llama 4 Scout heeft met tot tien miljoen tokens veruit het grootste contextvenster van allemaal, wat het aantrekkelijk maakt voor werk met enorme documentverzamelingen. En Muse Glimmer is bijzonder omdat het met 30 miljard parameters onder Apache 2.0 op één consumenten-GPU draait: je AI-gesprekken verlaten dan je eigen computer niet.
Wil je zelf iets bouwen met deze modellen, dan zijn de prijzen per miljoen tokens hierboven je startpunt. In AI-chatbot maken in het Nederlands rekenen we uit wat dat in de praktijk kost.
Welk model gebruik je waarvoor?
De korte samenvatting van alles hierboven, per taak.
| Taak | Sterkste keuze | Goedkoop alternatief |
|---|---|---|
| Nederlandse teksten schrijven | Claude Opus 5 of Sonnet 5 | Gratis Claude (Sonnet 5) |
| Programmeren | Claude Opus 5, Grok 4.5 | Kimi K2.7 Code |
| Lange documenten en pdf's | Gemini 3.1 Pro | Gemini 3.5 Flash |
| Alledaagse vragen | GPT-5.6 Terra | GPT-5.6 Luna (gratis) |
| Beeld genereren | GPT Image 2, Nano Banana Pro | — |
| Video genereren | Sora 2, Veo 3.1 | — |
| EU-verwerking | Mistral Medium 3.5 | Mistral Small 4 |
| Zelf draaien | Llama 4 | Muse Glimmer |
Twee taken vallen buiten dit rijtje. Wil je antwoorden mét bronvermelding, dan is een model niet genoeg en heb je een zoek-AI nodig zoals in Perplexity AI: de AI die wél bronnen vermeldt. En zoek je specifiek het model dat het beste Nederlands schrijft, dan hebben we dat apart getest in welke AI het beste Nederlands spreekt.
| Provider | Plan | List price | Per month in € | Per year |
|---|---|---|---|---|
| GoedkopeAIAll models below | Plus | €12.95 incl. VAT | €12.95 | €155 |
| ChatGPTOpenAI | Plus | $20 excl. VAT | €21.02 | €252 |
| ClaudeAnthropic | Pro | $20 excl. VAT | €21.02 | €252 |
| GeminiGoogle | Google AI Pro | €21.99 incl. VAT | €21.99 | €264 |
Wie per taak het beste model wil kiezen, zit al snel aan twee of drie abonnementen vast. Hoe die keuze per taak precies uitpakt, hebben we uitgewerkt in GPT-5.6 vs Claude 5 vs Gemini 3.5.
Conclusie
Frequently asked questions
Hoeveel AI-modellen zijn er eigenlijk?
Er zijn honderden modellen, maar in de praktijk doen er ongeveer twintig ertoe. Die komen van tien aanbieders: OpenAI, Anthropic, Google, xAI, Mistral, DeepSeek, Alibaba, Meta, Z.ai en Moonshot. De rest is een variant, een oudere versie of een model dat op een van deze is gebouwd.
Wat is het verschil tussen ChatGPT en GPT-5.6?
ChatGPT is de app waarin je typt, GPT-5.6 is het model dat het antwoord bedenkt. Hetzelfde geldt voor Claude (app) en Claude Sonnet 5 (model), en voor Gemini (app) en Gemini 3.1 Pro (model). In één app zitten meestal meerdere modellen, en je kunt vaak zelf kiezen welke je gebruikt.
Wat betekent een contextvenster van 1 miljoen tokens?
Het contextvenster is de hoeveelheid tekst die een model tegelijk kan overzien: je vraag, het eerdere gesprek, je bijlagen en het antwoord samen. Een token is ongeveer driekwart woord, dus een miljoen tokens komt neer op enkele duizenden pagina's tekst. Zit je eroverheen, dan vergeet het model het begin van het gesprek.
Welk AI-model is het beste in 2026?
Er is geen model dat op alles wint. Claude Opus 5 en Sonnet 5 schrijven het beste Nederlands, GPT-5.6 Sol heeft het breedste pakket eromheen, Gemini 3.1 Pro is sterk in documenten en research en Grok 4.5 is goed in code. Voor eenvoudige vragen zijn de goedkope modellen als GPT-5.6 Luna inmiddels ruim voldoende.