Naar de inhoud

Prijzen gecontroleerd op 10 augustus 2026

goedkopeai
AI-modellen uitgelegd

Alle AI-modellen op een rij: van GPT tot Gemini tot Claude

Sol, Terra, Luna, Fable, Opus, Sonnet, Flash. Een naslagwerk met alle AI-modellen van augustus 2026, gegroepeerd per aanbieder, met releasedatum, contextvenster en prijs.

10 min lezenDoor redactie GoedkopeAI

Sol, Terra, Luna, Fable, Opus, Sonnet, Flash, Scout, Maverick. De namen van AI-modellen zeggen een normale gebruiker weinig, en toch maakt het uit welke je gebruikt: het model bepaalt hoe goed het antwoord is, hoeveel tekst je erin kwijt kunt en wat je ervoor betaalt.

Deze pagina is bedoeld als naslagwerk. Hieronder staan alle modellen die er in augustus 2026 toe doen, gegroepeerd per aanbieder, met de releasedatum, het contextvenster en de prijs per miljoen tokens. Je hoeft ze niet uit je hoofd te kennen. Maar als je ergens een modelnaam tegenkomt, kun je hier opzoeken van wie hij is, waar hij voor bedoeld is en of hij bij jouw werk past.

Model, app en abonnement zijn drie verschillende dingen

De meeste verwarring komt doordat drie dingen door elkaar lopen. Het model is de motor: GPT-5.6 Sol, Claude Sonnet 5, Gemini 3.1 Pro. De app is wat je opent: ChatGPT, Claude, Gemini. Het abonnement bepaalt welke modellen je in die app mag gebruiken en hoe vaak. In één app zitten dus meerdere modellen, en dezelfde modellen zitten vaak ook in andere apps. Welk abonnement welke modellen ontsluit, staat in onze vergelijking van AI-abonnementen.

Vier begrippen kom je in elk overzicht tegen.

Tokens. De rekeneenheid van een taalmodel. Een token is een stukje van een woord; als vuistregel is duizend tokens ongeveer 750 woorden. Aanbieders rekenen per miljoen tokens af, apart voor wat je erin stopt (in) en wat eruit komt (uit).

Contextvenster. Hoeveel tekst het model tegelijk kan overzien: je vraag, het hele gesprek tot dan toe, je bijlagen en het antwoord bij elkaar. Een venster van een miljoen tokens komt neer op enkele duizenden pagina's. Loopt een gesprek eroverheen, dan valt het begin eruit en gaat het model dingen vergeten.

Open weights. Het model is als bestand te downloaden, zodat je het zelf op eigen hardware of bij een eigen hoster kunt draaien. Bij gesloten modellen kan dat niet: die draaien alleen bij de aanbieder zelf. Open weights zeggen iets over vrijheid en privacy, niet automatisch over kwaliteit.

Reasoning. Een modus waarin het model eerst stap voor stap uitwerkt hoe het tot een antwoord komt, voordat het antwoordt. Dat duurt langer en kost meer, maar levert merkbaar betere resultaten bij logica, wiskunde en code. Bij eenvoudige vragen is het zonde van de tijd.

ModelVanUitContextNederlandsSterk in
GPT-5.6 SolOpenAI9 juli 20261,05M tokensGoedZware analyses, agents en professioneel werk
GPT-5.6 TerraOpenAI9 juli 20261,05M tokensGoedDagelijks werk tegen een lagere prijs
GPT-5.6 LunaOpenAI9 juli 20261,05M tokensRedelijkSnelle vragen en hoge volumes
Claude Fable 5Anthropic9 juni 20261M tokensUitstekendMoeilijk, langdurig werk waar kwaliteit boven kosten gaat
Claude Opus 5Anthropicjuni 20261M tokensUitstekendComplexe redeneertaken en lange documenten
Claude Sonnet 5Anthropic30 juni 20261M tokensUitstekendDagelijks schrijven, coderen en agents
Gemini 3.5 FlashGoogle19 mei 20261,05M tokensGoedSnel multimodaal werk en grote volumes
Gemini 3.1 ProGooglepreview1M tokensGoedResearch en documentanalyse
Grok 4.5xAI8 juli 2026500K tokensRedelijkProgrammeren, engineering en actuele informatie
Mistral Medium 3.5openMistral AIapril 2026256K tokensGoedEuropese implementaties en agentwerk
Mistral Small 4openMistral AImaart 2026256K tokensRedelijkGoedkoop instrueren, redeneren en coderen
DeepSeek V4 ProopenDeepSeekapril 20261M tokensMatigGoedkoop redeneren en programmeren
Qwen 3.8 MaxAlibaba3 augustus 20261M tokensMatigMultimodale agents en code
Llama 4 Scout / MaverickopenMetaapril 202510M tokensRedelijkZelf hosten met extreem lange context
Muse GlimmeropenMetaaugustus 2026256K tokensMatigLokale agents op je eigen laptop
Modellenoverzicht bijgewerkt op 10 augustus 2026. Beoordeling Nederlands op basis van onze eigen tests met identieke prompts.

OpenAI: GPT-5.6 in drie smaken

OpenAI bracht op 9 juli 2026 één generatie uit in drie formaten. Ze delen hetzelfde contextvenster van 1,05 miljoen tokens en verschillen vooral in hoe zwaar en hoe duur ze zijn.

Model Uitgebracht Contextvenster API in–uit per miljoen tokens
GPT-5.6 Sol 9 juli 2026 1,05 miljoen $5 / $30
GPT-5.6 Terra 9 juli 2026 1,05 miljoen $1,25 / $10
GPT-5.6 Luna 9 juli 2026 1,05 miljoen $0,10 / $0,80

Sol is het vlaggenschip. Sinds de update van 6 augustus 2026 gaat het beter om met feiten en zit er in ChatGPT een effort-schuif waarmee je zelf bepaalt hoe lang het model over een antwoord mag nadenken. Terra is het middensegment en ongeveer even sterk als het vlaggenschip van vorig jaar, GPT-5.5, tegen een fractie van de prijs: op 30 juli 2026 ging er nog 20% af. Luna is de goedkoopste en sinds 6 augustus 2026 het standaardmodel voor gratis gebruikers en voor het Go-abonnement. De prijs van Luna daalde op 30 juli 2026 met 80%.

Dat gratis niveau is inmiddels serieus: onbeperkt tekstchatten op Luna plus een Think-knop voor zwaardere vragen. De limieten zitten nu op uploads, beeld en tools, niet meer op het aantal berichten. Betalen loont vooral als je het topmodel veel gebruikt — Plus geeft 160 berichten per drie uur op het zwaarste model, tegenover historisch tien berichten per vijf uur op het gratis plan.

Voor beeld en video heeft OpenAI GPT Image 2 en Sora 2, allebei inbegrepen in ChatGPT Plus. Dat is het duidelijkste argument om juist bij OpenAI te blijven: geen enkele andere aanbieder stopt videogeneratie in een abonnement van deze prijsklasse.

Anthropic: Claude Fable, Opus en Sonnet

Anthropic hanteert dezelfde driedeling, maar met een eigen accent: alle drie de modellen hebben een contextvenster van een miljoen tokens en de nadruk ligt op tekst, code en betrouwbaarheid.

Model Uitgebracht Contextvenster API in–uit per miljoen tokens
Claude Fable 5 9 juni 2026 1 miljoen $10 / $50
Claude Opus 5 juni 2026 1 miljoen $5 / $25
Claude Sonnet 5 30 juni 2026 1 miljoen $2 / $10

Fable 5 is het zwaarste en met afstand het duurste model op de markt. Let op: in de Claude-apps zit Fable 5 niet in het Pro-abonnement, je rekent het af met vooraf gekochte credits. Opus 5 is het redeneermodel voor moeilijke opgaven. Sonnet 5 is het werkpaard voor dagelijks gebruik en tegelijk het model dat je in de gratis versie van Claude krijgt — dat maakt gratis Claude een van de sterkste gratis opties die er zijn.

Wat Claude verder onderscheidt: Claude Pro bevat Claude Code en Claude Cowork, en training op je gesprekken staat op de betaalde consumentenplannen standaard uit. Zet je training wel aan, dan wordt je data langer bewaard. Meer over hoe Anthropic werkt en waarom het model zo goed Nederlands schrijft, lees je in Claude AI uitgelegd.

Google: Gemini 3.5 Flash en 3.1 Pro

Google werkt met twee sporen: een snel, breed inzetbaar model en een zwaarder model voor denkwerk.

Model Uitgebracht Contextvenster API in–uit per miljoen tokens
Gemini 3.5 Flash 19 mei 2026 1,05 miljoen $1,50 / $9
Gemini 3.1 Pro preview 1 miljoen $2 / $12

Gemini 3.5 Flash is het stabiele werkpaard en multimodaal: het verwerkt tekst, beeld en documenten in hetzelfde gesprek. Gemini 3.1 Pro staat nog als preview en is het zware model in Google AI Plus en Google AI Pro.

De reden dat veel Nederlanders bij Google uitkomen is niet het model maar wat eromheen zit. Google AI Pro (€21,99 per maand) geeft je een contextvenster van een miljoen tokens, Deep Research, NotebookLM en 2 TB opslag. Google AI Plus kost €7,99 en heeft 200 GB opslag. Voor beeld en video heeft Google Nano Banana Pro en Veo 3.1. Hoe dat abonnement in elkaar zit — en waarom je het misschien al hebt zonder het te weten — staat in Gemini AI uitgelegd.

xAI en Mistral: Grok en de Europese optie

Grok 4.5 van xAI verscheen op 8 juli 2026, heeft een contextvenster van 500.000 tokens en kost $2 in en $6 uit per miljoen tokens. Het is sterk in code en het enige model met directe toegang tot live data van X. Het contextvenster is kleiner dan bij de concurrentie, en het abonnement is met €31,53 per maand het duurste standaardplan van de grote aanbieders.

Mistral is de Franse aanbieder en voor Nederlandse gebruikers relevant om een andere reden: de verwerking gebeurt in de EU, in Frankrijk en Zweden. Alle drie de modellen hebben een contextvenster van 256.000 tokens.

Model Uitgebracht Licentie API in–uit per miljoen tokens
Mistral Medium 3.5 april 2026 open weights, aangepaste MIT $1,50 / $7,50
Mistral Large 3 december 2025 Apache 2.0 $0,50 / $1,50
Mistral Small 4 maart 2026 Apache 2.0 $0,15 / $0,60

Medium 3.5 is het model dat je in Le Chat Pro (€15,76 per maand) gebruikt, inclusief een modus zonder telemetrie. Small 4 is multimodaal en zo goedkoop dat het voor eigen toepassingen vaak het verstandigste startpunt is. Eerlijk is eerlijk: op de zwaarste taken halen de Mistral-modellen het niveau van Sol of Opus 5 niet. Je kiest ze om waar je data staat, niet om de topprestatie.

De open modellen: DeepSeek, Qwen, Llama en de rest

Deze groep gebruik je zelden via een consumentenabonnement. Je komt ze tegen als je zelf iets bouwt of iets op eigen hardware wilt draaien. De prijzen hangen dan af van je hoster, niet van de maker.

Model Maker Uitgebracht Contextvenster Waar het voor is
DeepSeek V4 Pro / Flash DeepSeek april 2026 1 miljoen Zeer goedkoop: $0,435 / $0,87 en $0,14 / $0,28
Qwen 3.8 Max Alibaba 3 augustus 2026 1 miljoen Nieuwste Alibaba-model, getrapte prijzen
Llama 4 Scout / Maverick Meta april 2025 tot 10 miljoen De standaard voor zelf hosten
Muse Glimmer Meta augustus 2026 256.000 30B, Apache 2.0, draait op één consumenten-GPU
GLM-5.2 Z.ai 16 juni 2026 1 miljoen Open engineeringmodel
Kimi K2.7 Code Moonshot juni 2026 256.000 Lange runs van codeeragents
MiniMax M3 MiniMax 1 juni 2026 tot 1 miljoen Efficiënt multimodaal, $0,30 / $1,20

Twee opmerkingen hierbij. Llama 4 Scout heeft met tot tien miljoen tokens veruit het grootste contextvenster van allemaal, wat het aantrekkelijk maakt voor werk met enorme documentverzamelingen. En Muse Glimmer is bijzonder omdat het met 30 miljard parameters onder Apache 2.0 op één consumenten-GPU draait: je AI-gesprekken verlaten dan je eigen computer niet.

Wil je zelf iets bouwen met deze modellen, dan zijn de prijzen per miljoen tokens hierboven je startpunt. In AI-chatbot maken in het Nederlands rekenen we uit wat dat in de praktijk kost.

Welk model gebruik je waarvoor?

De korte samenvatting van alles hierboven, per taak.

Taak Sterkste keuze Goedkoop alternatief
Nederlandse teksten schrijven Claude Opus 5 of Sonnet 5 Gratis Claude (Sonnet 5)
Programmeren Claude Opus 5, Grok 4.5 Kimi K2.7 Code
Lange documenten en pdf's Gemini 3.1 Pro Gemini 3.5 Flash
Alledaagse vragen GPT-5.6 Terra GPT-5.6 Luna (gratis)
Beeld genereren GPT Image 2, Nano Banana Pro —
Video genereren Sora 2, Veo 3.1 —
EU-verwerking Mistral Medium 3.5 Mistral Small 4
Zelf draaien Llama 4 Muse Glimmer

Twee taken vallen buiten dit rijtje. Wil je antwoorden mét bronvermelding, dan is een model niet genoeg en heb je een zoek-AI nodig zoals in Perplexity AI: de AI die wél bronnen vermeldt. En zoek je specifiek het model dat het beste Nederlands schrijft, dan hebben we dat apart getest in welke AI het beste Nederlands spreekt.

AanbiederAbonnementListprijsPer maand in €Per jaar
GoedkopeAIAlle modellen hieronderPlus€12,95 incl. btw€12,95€155
ChatGPTOpenAIPlus$20 excl. btw€21,02€252
ClaudeAnthropicPro$20 excl. btw€21,02€252
GeminiGoogleGoogle AI Pro€21,99 incl. btw€21,99€264
Prijzen gecheckt op 10 augustus 2026. Dollarbedragen omgerekend tegen $1 = €0,8687 en verhoogd met 21% btw, zoals een Nederlandse consument ze op de factuur ziet. Google en Microsoft rekenen in Nederland direct in euro's inclusief btw.

Wie per taak het beste model wil kiezen, zit al snel aan twee of drie abonnementen vast. Hoe die keuze per taak precies uitpakt, hebben we uitgewerkt in GPT-5.6 vs Claude 5 vs Gemini 3.5.

Conclusie

Veelgestelde vragen

Hoeveel AI-modellen zijn er eigenlijk?

Er zijn honderden modellen, maar in de praktijk doen er ongeveer twintig ertoe. Die komen van tien aanbieders: OpenAI, Anthropic, Google, xAI, Mistral, DeepSeek, Alibaba, Meta, Z.ai en Moonshot. De rest is een variant, een oudere versie of een model dat op een van deze is gebouwd.

Wat is het verschil tussen ChatGPT en GPT-5.6?

ChatGPT is de app waarin je typt, GPT-5.6 is het model dat het antwoord bedenkt. Hetzelfde geldt voor Claude (app) en Claude Sonnet 5 (model), en voor Gemini (app) en Gemini 3.1 Pro (model). In één app zitten meestal meerdere modellen, en je kunt vaak zelf kiezen welke je gebruikt.

Wat betekent een contextvenster van 1 miljoen tokens?

Het contextvenster is de hoeveelheid tekst die een model tegelijk kan overzien: je vraag, het eerdere gesprek, je bijlagen en het antwoord samen. Een token is ongeveer driekwart woord, dus een miljoen tokens komt neer op enkele duizenden pagina's tekst. Zit je eroverheen, dan vergeet het model het begin van het gesprek.

Welk AI-model is het beste in 2026?

Er is geen model dat op alles wint. Claude Opus 5 en Sonnet 5 schrijven het beste Nederlands, GPT-5.6 Sol heeft het breedste pakket eromheen, Gemini 3.1 Pro is sterk in documenten en research en Grok 4.5 is goed in code. Voor eenvoudige vragen zijn de goedkope modellen als GPT-5.6 Luna inmiddels ruim voldoende.

Alle prijzen en modelnamen in dit artikel zijn gecontroleerd op 10 augustus 2026. Aanbieders wijzigen hun tarieven regelmatig: controleer bij twijfel de website van de aanbieder zelf. Zie je een fout? Laat het ons weten.

Verder lezen

Tot slot

Stop met vier AI‑abonnementen betalen.

Eén Nederlands abonnement voor alle topmodellen. Begin gratis, upgrade als je tegen de limieten aanloopt en zeg maandelijks op.