De Belegger

Van de redactie

Het duurste Claude-model kan per taak goedkoper uitpakken

Anthropic zet Haiku 5.5, Sonnet 5.5, Opus 5.5 en Fable 5.1 op vier prijsniveaus. De duurste tokens kunnen toch de goedkoopste oplossing geven als een taak vaker in één keer slaagt. Dat moet wel op eigen werk worden bewezen.

Omslagfoto: Dario Amodei (archieffoto, 2023-05-24). Foto: Simon Walker / No 10 Downing Street / Wikimedia Commons / CC BY 2.0; uitsnede door Edward. Bron en beeldverantwoording · CC BY 2.0

In het kort

Claude Haiku 5.5, Sonnet 5.5, Opus 5.5 en Fable 5.1 maakt moeilijke code-, onderzoeks- en documenttaken afronden technisch haalbaar, maar de doorslaggevende kosten zitten in een dure modelkeuze op basis van één leveranciersbenchmark. De actuele familie loopt van Haiku 5.5 vanaf $0,10 input en $0,50 output tot Fable 5.1 op $10 en $50 per miljoen tokens. Anthropic publiceert daarnaast een eigen voorbeeld waarin Fable 5.1 bij lage inspanning minder kost per opgeloste taak dan een oudere Sonnet-configuratie. De analyse rekent daarom terug vanaf geaccepteerd werk en laat zien hoeveel tijd of kwaliteit de inzet moet opleveren. De uitkomst is geen rendementsgarantie, maar een beslisgrens die een organisatie met eigen meetgegevens kan toetsen.

Een model met vijf of tien keer hogere tokenprijzen kan goedkoper zijn wanneer het veel minder pogingen en menselijk herstel vraagt. Maar een leveranciersvoorbeeld is geen bewijs voor Nederlandse dossiers, eigen code of een eigen acceptatiegrens.

De eerste fout in veel vergelijkingen is dat de modelprijs wordt behandeld als de volledige kostprijs. In de praktijk horen ook integratie, logging, evaluatie, beveiliging en de tijd van medewerkers bij de rekening. Een goedkope API kan daardoor de duurste route worden wanneer veel antwoorden opnieuw moeten worden gevraagd of gecontroleerd. Andersom kan een duurder model rationeel zijn wanneer het aantoonbaar minder herstelwerk veroorzaakt.

De Belegger · analyse

Model en toegang

Feiten, toegang en prijs horen bij elkaar.

Claude Haiku 5.5, Sonnet 5.5, Opus 5.5 en Fable 5.1Actuele familie
Commerciële Claude API; modeltoegang en beschikbaarheid via AWS of andere platforms kunnen verschillenNiet verwarren met gratis toegang
Peildatum10 oktober 2026
Aankondiging, preview, API-toegang en downloadbare gewichten zijn afzonderlijke statussen.

Wat de actuele modelinformatie wel en niet zegt

Volgens de Anthropic-overzicht van actuele Claude-modellen geldt op 10 oktober 2026 het volgende: De actuele familie loopt van Haiku 5.5 vanaf $0,10 input en $0,50 output tot Fable 5.1 op $10 en $50 per miljoen tokens. Anthropic publiceert daarnaast een eigen voorbeeld waarin Fable 5.1 bij lage inspanning minder kost per opgeloste taak dan een oudere Sonnet-configuratie. Die gegevens zijn bruikbaar voor een eerste begroting, maar ze zeggen niet hoeveel taken in het Nederlands goed eindigen, hoeveel pogingen nodig zijn of hoeveel menselijke controle resteert.

Kosten per opgeloste taak dwingen tot een eerlijkere noemer. Een antwoord dat €0,20 kost maar drie keer moet worden herhaald, is niet goedkoper dan een antwoord van €0,45 dat direct wordt geaccepteerd. Ook de tijd van de controleur hoort in die vergelijking.

De inspanningsinstelling is een tweede knop. Een krachtig model op lage inspanning kan soms beter passen dan een kleiner model dat lang redeneert. De test moet daarom model én inspanning vastleggen.

Beschikbaarheid moet bovendien precies worden benoemd. Commerciële Claude API; modeltoegang en beschikbaarheid via AWS of andere platforms kunnen verschillen. Een model dat via een chatdienst gratis is te proberen, is daarmee niet automatisch vrij inzetbaar in een productieomgeving. Evenmin betekent een openbare modelkaart dat de gewichten downloadbaar zijn of dat commercieel gebruik zonder voorwaarden is toegestaan.

De tweede primaire bron is de Anthropic-uitleg over kosten per opgeloste taak. Die helpt om de technische mogelijkheden te plaatsen, maar leveranciersdocumentatie blijft leveranciersinformatie. Benchmarkresultaten zijn meestal uitgevoerd onder vaste instellingen en zeggen weinig over eigen documenten, Nederlandse formuleringen, koppelingen of fouten die buiten de testset vallen.

Daarom is een kleine, representatieve proef belangrijker dan een lange lijst scores. Kies twintig tot honderd echte taken, leg vooraf vast wat goed genoeg is en laat een inhoudsdeskundige blind beoordelen. Meet daarna kosten per geaccepteerde taak, niet alleen kosten per miljoen tokens. Dat voorkomt dat een model met lage tarieven wint terwijl medewerkers veel correcties uitvoeren.

De proef moet ook het normale werkritme nabootsen. Een laboratoriumtest met één korte prompt mist precies de onderdelen die in productie geld kosten: grote bijlagen, meerdere gebruikers, wisselende talen, toolfouten en piekbelasting. Voor moeilijke code-, onderzoeks- en documenttaken afronden hoort daarom minstens één rustige dag, één druk moment en één foutscenario in de test. Zo wordt zichtbaar of een dure modelkeuze op basis van één leveranciersbenchmark incidenteel is of structureel terugkomt.

Let daarnaast op de volgorde van handelingen. Een workflow die eerst alle documenten naar het duurste model stuurt, verspilt capaciteit wanneer een simpele filter de helft kan verwijderen. Omgekeerd kan te vroeg filteren relevante informatie weggooien. De beste keten gebruikt een goedkoop selectiemechanisme, een passend hoofdmodel en een gerichte controle. Iedere stap krijgt een eigen meetpunt, zodat duidelijk blijft waar kwaliteit verloren gaat.

Databeheer hoort vanaf het begin in de opzet. Leg vast welke invoer mag worden bewaard, wie logs kan zien en hoe lang voorbeelden voor evaluatie beschikbaar blijven. De modeluitkomst kan bedrijfsinformatie bevatten, ook wanneer de oorspronkelijke prompt onschuldig lijkt. Een leverancier die niets bewaart, neemt bovendien de eigen plicht tot toegangsbeheer, geheimhouding en incidentregistratie niet over.

Een derde aandachtspunt is versiebeheer. Leveranciers vervangen aliassen, voegen modellen toe en beëindigen endpoints. Open gewichten veranderen minder onverwacht, maar de runtime, quantisatie en promptlaag kunnen wel verschuiven. Bewaar daarom een kleine vaste regressieset en draai die opnieuw vóór iedere wijziging. Zonder zo’n anker is een kwaliteitsdaling moeilijk te onderscheiden van veranderde brondata of menselijk beoordelingsverschil.

Ook de personeelskant verdient een eigen regel in het budget. Medewerkers moeten leren wanneer het model mag handelen, wanneer een bron nodig is en hoe een fout wordt gemeld. Die opleiding is geen eenmalige kostenpost, omdat modellen en werkprocessen blijven veranderen. Een project dat alleen tijdens de pilot door twee enthousiastelingen wordt gedragen, heeft nog geen schaalbaar bedrijfsproces bewezen.

Ten slotte moet de organisatie een alternatief houden. Dat kan een tweede API, een kleiner lokaal model of een handmatige noodprocedure zijn. Redundantie kost geld, maar voorkomt dat een storing of plotselinge prijswijziging het hele proces stilzet. De waarde ervan is het grootst bij werk met deadlines. Juist daar kan één uur uitval duurder zijn dan een maand aan reservekosten.

De Belegger · analyse

Van opdracht naar bruikbaar resultaat

De goedkoopste run is niet altijd de goedkoopste uitkomst.

1
100 opdrachten

moeilijke code-, onderzoeks- en documenttaken afronden

2
77 technisch afgerond

Leveranciersclaim en benchmark zijn nog geen acceptatie.

3
68 geaccepteerd

Na controle, retries en herstel.

De omgekeerde rekensom maakt de grens zichtbaar

Voor het rekenvoorbeeld nemen we maandelijkse model-, beheer- en controlekosten van € 760. De waarde van een vrijgespeeld arbeidsuur is € 72. De minimale besparing is dan € 760 gedeeld door € 72, oftewel 10.6 uur per maand. Dat is de drempel vóór financieringskosten, belastingen en een risicomarge.

De lage, midden- en hoge scenario’s veronderstellen respectievelijk 8, 20 en 41 bespaarde minuten per werkdag. We rekenen met 220 werkdagen. De bruto tijdswaarde is minuten per dag maal 220 gedeeld door zestig, maal € 72. Daar trekken we twaalf maal € 760 vanaf. Het verschil is de netto kasbesparing in het schema.

Deze formule telt alleen tijd die werkelijk uit betaald werk verdwijnt. Als een medewerker de vrijgekomen minuten niet anders kan inzetten, ontstaat geen directe kasbesparing. Ook mag dezelfde winst niet dubbel worden geteld als snellere doorlooptijd én extra productie, tenzij beide afzonderlijk zijn gemeten. Hetzelfde geldt voor minder fouten: de vermeden herstelkosten mogen niet nogmaals als tijdsbesparing terugkomen.

Voor extractie, classificatie en korte antwoorden blijft Haiku vaak logisch. Daar is de taak strak en is het kwaliteitsverschil mogelijk klein. Het duurste model als standaard kiezen is dan net zo onzorgvuldig als altijd het goedkoopste nemen.

De Belegger · analyse

De omgekeerde rekensom

Hoeveel tijd moet de inzet per maand werkelijk vrijmaken?

Benodigde tijd = maandkosten ÷ uurwaarde
€ 760 ÷ € 72/uur = 10.6 uur = 633 minuten
Laag8 min/dag
Midden20 min/dag
Hoog41 min/dag
Alleen tijd die aantoonbaar uit betaald werk verdwijnt telt mee. Een sneller concept met evenveel controle is geen volledige besparing.

Voor 2027, 2028 en 2029 houden we dezelfde uurwaarde en maandkosten aan. Dat is bewust conservatief en maakt zichtbaar welke benutting nodig is zonder een verzonnen daling van tokenprijzen. In werkelijkheid kunnen tarieven, modellen en hardware sneller veranderen dan de interne processen. Een jaarlijkse herijking is daarom noodzakelijk.

De scenario’s zijn geen voorspelling van de markt, maar een toets voor de eigen organisatie. Het lage scenario past bij een voorzichtige invoering met veel controles. Het middenscenario veronderstelt dat de workflow stabiel is en medewerkers de uitkomsten gericht nakijken. Het hoge scenario vraagt structureel gebruik, weinig uitval en voldoende vraag naar de vrijgekomen capaciteit. Als alleen het hoge scenario positief is, ligt het risico grotendeels bij de koper. Een gezonde businesscase blijft ook bij het middenscenario overeind en kan een tijdelijke prijsstijging of tegenvallende nauwkeurigheid opvangen.

De Belegger · analyse

Drie jaren, drie scenario’s

Netto kasbesparing na modelkosten en controle.

2027Laag € 0Midden € 0Hoog € 1704
2028Laag € 0Midden € 0Hoog € 1704
2029Laag € 0Midden € 0Hoog € 1704
Aannames: 220 werkdagen, vaste uurwaarde € 72, maandkosten € 760. Het model veronderstelt geen omzetgroei en telt retries niet dubbel.

Wat een koper of belegger hieruit kan halen

Test alle vier modellen op dezelfde set en registreer eerste-pogingssucces, correctieminuten en totale tokens. Gebruik Haiku voor voorspelbaar volume, Sonnet als brede basis en schaal alleen op wanneer Opus of Fable aantoonbaar goedkoper is per geaccepteerde taak.

Voor inkopers is een proefcontract met meetbare service-eisen verstandiger dan een brede uitrol. Leg modelversie, regio, logretentie, maximale kosten per taak en een exitroute vast. Voor open gewichten horen ook de licentieversie, quantisatie, runtime en gebruikte fine-tune in het register. Zonder die gegevens is een resultaat later niet reproduceerbaar.

Voor beleggers is lagere tokenprijs op zichzelf geen bewijs van een beter verdienmodel. Goedkopere inferentie kan het gebruik versnellen, maar ook de brutomarge drukken en de concurrentie vergroten. De relevante vragen zijn hoeveel klanten blijven, hoeveel hoogwaardige taken worden uitgevoerd en of de leverancier inkomsten uit tools, hosting of bedrijfscontracten toevoegt zonder dat supportkosten even hard oplopen.

De praktische conclusie is nuchter. Claude Haiku 5.5, Sonnet 5.5, Opus 5.5 en Fable 5.1 kan waarde leveren, maar alleen wanneer een dure modelkeuze op basis van één leveranciersbenchmark vooraf meetbaar wordt gemaakt. Start klein, vergelijk dezelfde taak, bewaak stopregels en laat de organisatie pas opschalen nadat de omgekeerde rekensom positief is. De modelnaam is het begin van de keuze, niet het bewijs dat de businesscase werkt.

Word lid van De Belegger

Alle prijzen zijn inclusief btw. Eén keer kiezen, meteen alles open.

Met de code GRAAG krijg je 33 procent korting op 5 Jaar, Half Jaar en Ere lid, tot en met 18 oktober 2026, 23:59.

Ere lid

€ 1.500 € 1.005 eenmalig

  • Onbeperkte toegang tot columns, nieuws, verdieping en analyse over de allerbeste aandelen
  • Echte verdieping in de cijfers en het management
  • De Belegger portefeuille, gedeeld met tekst en uitleg bij elke transactie
  • Trainingen die van jou de allerbeste belegger maken, altijd in controle
  • Alles op de site en in de app

gewoon altijd toegang tot alles

Uitgelicht

5 Jaar

€ 799 € 535,33 eenmalig

  • Onbeperkte toegang tot columns, nieuws, verdieping en analyse over de allerbeste aandelen
  • Echte verdieping in de cijfers en het management
  • De Belegger portefeuille, gedeeld met tekst en uitleg bij elke transactie
  • Trainingen die van jou de allerbeste belegger maken, altijd in controle
  • Alles op de site en in de app

verloopt automatisch na 5 jaar, geen abonnement

Bekijk de lidmaatschappen

We willen alleen tevreden klanten: niet tevreden binnen 14 dagen, dan je geld terug. Ook per half jaar mogelijk: € 199 elke 6 maanden.

Bronnen

Lees ook

Deel dit artikel

WhatsAppXLinkedIn

Open in de app