Live beslisblad Claude · ChatGPT · Gemini

Kies het model dat je taak verdient.

Geen merkstrijd, maar een onderbouwde keuze per klus. Vergelijk kwaliteit, snelheid, taakprijs en denkniveau — afgestemd op jouw ontwikkelwerk.

Gebaseerd op onafhankelijke benchmarks, API-prijzen en praktijkverhalen.

Modelvizier / AA IndexActuele kopgroep
● Live
Opus 5Anthropic
61
GPT-5.6 SolOpenAI
59
3.6 FlashGoogle DeepMind
50
Oordeel voor dagelijks bouwenSol highSnel genoeg om te itereren, sterk genoeg voor de hele keten.
61 hoogste totaalscore13 submodellen vergeleken$0,21 goedkoopste indextaak6 persoonlijke usecases
Het korte antwoord

Welke is momenteel beter?

Geen enkel model wint alles. Kies eerst wat je ermee wilt doen.

Onze keuze voor alleskunner

GPT-5.6 Sol is de veiligste allround keuze

Het verschil met Claude is klein, terwijl snelheid, coding en presentatiekwaliteit samen een sterke dagelijkse mix vormen.

Anthropic#1

Claude

Opus 5
61/ 100
AA Index

De nipte leider in onafhankelijke intelligentie-evaluaties en opvallend sterk bij lang, zelfstandig kenniswerk.

  • Agentisch kenniswerk
  • Complexe codebases
  • Lange opdrachten
OpenAI#2

ChatGPT

GPT-5.6 Sol
59/ 100
AA Index

Bijna dezelfde intelligentie als de leider, maar sneller en goedkoper per zware taak. De huidige coding-koploper.

  • Coding agents
  • Presentatiekwaliteit
  • Snelheid per taak
Google DeepMind#3

Gemini

3.6 Flash
50/ 100
AA Index

De snelste werkmodelkeuze voor zeer lange, multimodale context, iteratief codingwerk en diepe Google-integratie.

  • 1M multimodale context
  • 242 outputtokens/s
  • Video, audio en beeld
Afgestemd op jouw werk

De beste modellen voor jouw stack

Nuxt/Vue, Express, FileMaker, end-to-end debugging en uitleg in helder Nederlands.

01

Kleine Nuxt/Vue-fix

GPT-5.6 Luna · high

Snel en goedkoop voor één component, stylingfix of afgebakende route.

Alternatief: Gemini 3.6 Flash bij veel screenshots of context.
02

Browser → Express → FileMaker debug

GPT-5.6 Sol · high

Sterke coding-agent, goed in ketens volgen en runtimecontracten controleren.

Alternatief: Opus 5 high als het probleem bijzonder grillig is.
03

Complete accountflow bouwen

Claude Opus 5 · xhigh

Geschikt voor lange wijzigingen over UI, sessie, API, FileMaker-layout en tests.

Alternatief: Sol xhigh voor sneller en goedkoper resultaat.
04

Nederlandse uitleg & onboarding

Claude Sonnet 5 · high

Sterke structuur en nuance zonder direct de duurste Opus-laag nodig te hebben.

Alternatief: Terra high voor compactere documentatie.
05

Grote repo of veel documenten

Gemini 3.6 Flash · high

Snelste output en de sterkste gemeten 128k-contextscore in deze selectie.

Alternatief: Opus 5 high voor moeilijkere ontwerpbeslissingen.
06

Relatiegrafiek & visuele controle

Gemini 3.6 Flash · high

Sterk met beeld, diagrammen en grote multimodale context.

Alternatief: Sol high voor de aansluitende implementatie.
Mijn standaardadviesSol high als uitvoerderOpus 5 xhigh als reviewer bij moeilijke architectuurLuna high voor goedkope verkenning
Volledige catalogus

Families, submodellen & niveaus

Algemene tekst- en visionmodellen. Losse beeld-, audio- en embeddingmodellen zijn bewust niet vermengd.

ModelStatusAA-scoreAPI $ in / uitContextDenkstandenBeste inzet
ClaudeOpus 5Actueel61$5 / $251Madaptive · low · medium · high · xhigh · maxZwaar coding- en kenniswerk
ClaudeSonnet 5Actueel53$2 / $101Muit · adaptive · low · medium · high · xhigh · maxDagelijks agentwerk
ClaudeFable 5Specialist60$10 / $501M+adaptive · max + fallbackLangste autonome projecten
ClaudeHaiku 4.5Actueel$1 / $5200kextended thinkingSnelle subtaken en volume
ClaudeOpus 4.8Vorige generatie56$5 / $251Mlow · medium · high · xhigh · maxBewezen workhorse
GPT-5.6SolActueel59$5 / $301,05Mnone · low · medium · high · xhigh · maxCoding, ontwerp en agents
GPT-5.6TerraActueel55$2.5 / $151,05Mnone · low · medium · high · xhigh · maxGebalanceerd dagelijks werk
GPT-5.6LunaActueel51$1 / $61,05Mnone · low · medium · high · xhigh · maxVolume, subtaken en scouting
GPT-5.5InstantChatmodelProductprijsProductautomatischSnel alledaags gesprek
Gemini3.6 FlashActueel50$1.5 / $7.51Mminimal · low · medium · highMultimodaal, snel, lange context
Gemini3.5 Flash-LiteActueel36$0.3 / $2.51Mminimal · low · medium · highHoog volume en classificatie
Gemini3.5 FlashVervangen50$1.5 / $91Mminimal · low · medium · highGebruik nu 3.6 Flash
Gemini3.1 ProVorige generatie46$2 / $121Mlow · medium · highDiep multimodaal redeneren

API-prijzen zijn per 1M tokens. Sonnet 5 gebruikt tot en met 31 augustus 2026 de introductieprijs van $2 / $10. De denkgrafiek toont alleen onafhankelijk gemeten standen.

Meer denken is niet gratis

Wat doet het denkniveau met de score?

49
lowkort en scherp
54
mediumgoede dagelijkse basis
56
highcomplexe code
58
xhighzwaar agentwerk
59
maxabsolute top

AA Intelligence Index. Dezelfde tokenprijs per model, maar hogere standen gebruiken doorgaans meer redeneertokens en verhogen dus de taakprijs en wachttijd.

De cijfers

Benchmark explorer

Schakel tussen meetlatten. Een streepje is eerlijker dan een verzonnen vergelijking.

Beste score per dollarGPT-5.6 Luna · max

51 punten voor circa $0,21 per indextaak.

Beste premiumwaardeGPT-5.6 Sol · max

59 punten voor $1,04; één derde van Fable.

Beste multimodale snelheidGemini 3.6 Flash

242 tok/s, 1M context en beeld, audio en video.

Rechtsboven is beter

Intelligentie versus betaalbaarheid

● AA gemeten
Hogere intelligentie ↑Betaalbaarder per taak →
Luna
Gemini 3.6 Flash
Terra
Sol
Sonnet 5
Opus 5
Fable 5
Lager is beter

Kosten per indextaak

GPT-5.6 Luna
$0.21
Gemini 3.6 Flash
$0.50
GPT-5.6 Terra
$0.55
GPT-5.6 Sol
$1.04
Claude Sonnet 5
$1.53
Claude Opus 5
$2.03
Claude Fable 5
$2.75
Geselecteerde meetlat

AA Intelligence Index

● Bronnen gecontroleerd
1Claude Opus 5
61/ 100
2GPT-5.6 Sol
59/ 100
3Gemini 3.6 Flash
50/ 100

Onafhankelijke samengestelde score, actuele topmodellen.

Werkmodellen naast elkaar

Praktische benchmarkmatrix

Zelfde tests en harnas, gepubliceerd bij Gemini 3.6 Flash.

BenchmarkGemini 3.6GPT LunaClaude Sonnet 5Wat meet dit?
SWE-Bench Pro58,7%62,7%63,2%Diverse echte code-issues
DeepSWE 1.149%67%54%Langdurig softwarewerk
Terminal-Bench 2.178,0%84,7%80,4%Terminal en systeemwerk
GDPval-AA v2142115841607Economisch kenniswerk
OSWorld-Verified83,0%72,6%81,2%Computerbediening
CharXiv85,2%82,7%77,0%Grafieken en figuren lezen
MRCR 128k91,8%74,8%71,6%Informatie uit lange context
De modelrace

Laatste nieuws

Leeswijzer

Scores zijn een kompas,
geen eindvonnis.

De hoofdscore komt uit de onafhankelijke Artificial Analysis Intelligence Index v4.1, die negen evaluaties voor redeneren, kennis, coding, agents en instructievolging bundelt. Producentbenchmarks tonen we alleen met datum en modelversie.

Uitkomsten veranderen door redeneerstand, hulpmiddelen, prompt, prijs en productomgeving. Test daarom altijd een eigen representatieve taak voordat je een abonnement of API-keuze vastlegt.

Laatste volledige datacheck: 28 juli 2026. Prijzen, contextvensters, beschikbare denkstanden en actuele kopgroepscores zijn opnieuw gecontroleerd.