AI-tools
Nieuw Claude-model levert topprestaties tegen halve prijs, maar verzint vaker iets
Claude Opus 5 evenaart in onafhankelijke tests het veel duurdere topmodel van Anthropic, tegen de helft van de tokenprijs, maar geeft ook vaker een verkeerd antwoord.
Samengesteld met AI-assistentie uit de onderstaande bronnen, nagelezen en geduid door Frederiek Pascal. Hoe dit werkt
In het kort
- Claude Opus 5 kost 5 dollar per miljoen invoertokens en 25 dollar per miljoen uitvoertokens, evenveel als zijn voorganger en de helft van topmodel Fable 5.
- Op de onafhankelijke Intelligence Index van Artificial Analysis haalt Opus 5 61 punten, net voor Fable 5 (60) en GPT-5.6 Sol (59).
- Het model antwoordt vaker ook als het onzeker is: het hallucinatiecijfer steeg met 14 punten naar 50 procent, dus nazicht blijft nodig bij feitelijk werk.
- Voor Vlaamse bedrijven telt vooral dat het model via Amazon Bedrock ook in Ierse en Zweedse datacenters draait, waarbij AWS zegt je gegevens standaard niet te bewaren.
- De hoogste rekenstand is niet automatisch de beste: onafhankelijke tests van Vals.ai zien betere codeerresultaten op stand 'high' dan op 'xhigh' of 'max'.
Anthropic heeft op 24 juli Claude Opus 5 uitgebracht, het nieuwe topmodel in zijn Claude-familie. Het belangrijkste voor wie het gebruikt: de prijs blijft exact gelijk aan die van de voorganger Opus 4.8, terwijl de prestaties volgens zowel Anthropic als onafhankelijke testers een flinke sprong maken. Het model is meteen de standaardkeuze in het duurste abonnement Claude Max en het sterkste model dat je krijgt in Claude Pro.
De vergelijking die Anthropic zelf maakt, is met Fable 5, het duurdere en zwaardere model dat in juni uitkwam. Opus 5 komt volgens het bedrijf “close to the frontier intelligence of Claude Fable 5 at half the price”. Dat prijsverschil is concreet: Opus 5 rekent 5 dollar per miljoen invoertokens en 25 dollar per miljoen uitvoertokens, tegenover 10 en 50 dollar bij Fable 5. Tokens zijn de tekstbrokjes waarmee AI-leveranciers afrekenen, ruwweg te vergelijken met woorddelen. Voor wie sneller wil werken is er een nieuwe Fast Mode, die volgens Anthropic 2,5 keer sneller antwoordt maar het dubbele kost.
Kloppen die prestatieclaims ook buiten Anthropic?
Grotendeels wel, volgens twee onafhankelijke testhuizen. Artificial Analysis geeft Opus 5 een score van 61 op zijn Intelligence Index, een samenstelling van negen tests over kenniswerk, programmeren, wetenschappelijk redeneren en feitelijke juistheid. Daarmee staat het net voor Fable 5 (60), GPT-5.6 Sol van OpenAI (59), Kimi K3 (57) en Opus 4.8 (56). Wel belangrijk om te weten: Artificial Analysis testte het model samen met Anthropic vóór de publieke release.
Epoch AI komt tot een iets ander beeld. Dat instituut geeft Opus 5 een score van 159 op zijn Capability Index, net onder Fable 5 (161), met GPT-5.6 Sol op de eerste plaats. Op puur softwareontwikkeling komen Opus 5 en Fable 5 gelijk uit. De conclusie die The Decoder daaruit trekt: de topmodellen zitten zo dicht bij elkaar dat geen enkele aanbieder echt wegloopt van de rest.
Voor kantoorwerk zijn de cijfers opvallender dan voor programmeren. Op AA-Briefcase, een test met typische bureautaken zoals onderzoeksrapporten schrijven, presentaties bouwen en spreadsheets analyseren, haalt Opus 5 op zijn hoogste stand een Elo van 1720 tegenover 1574 voor Fable 5. De kostprijs per taak zakte daarbij naar 17,79 dollar, tegen 22,30 dollar voor Fable 5. Op de lagere stand “high” kost dezelfde taak 10,41 dollar en blijft het model nog steeds boven Fable 5 in de rangschikking. Op één punt verliest Opus 5: de visuele afwerking van presentaties, waar GPT-5.6 Sol ongeveer 40 Elo-punten voorstaat.
Wat is de keerzijde?
Het model geeft vaker een antwoord wanneer het eigenlijk onzeker is, en dat merk je aan de betrouwbaarheid. Artificial Analysis meet een hallucinatiecijfer van 50 procent, 14 punten hoger dan bij de voorganger. Op de test die de juistheid van kennisclaims meet, ging Opus 5 wel 7 punten vooruit tegenover Opus 4.8, maar het blijft achter op Fable 5. Voor wie AI gebruikt om feiten, cijfers of juridische en medische informatie te produceren, is dat geen detail: nazicht door een mens blijft noodzakelijk.
Er is ook een tegenintuïtieve bevinding. Opus 5 heeft vijf standen waarmee je kiest hoeveel rekenwerk het model in een antwoord stopt: low, medium, high, xhigh en max. Meer is niet altijd beter. Testbureau Vals.ai zag bij programmeertaken scores klimmen van 76,7 procent op “low” naar 89,8 procent op “high”, om daarna te zakken naar 88,3 procent op “xhigh” en 88,4 procent op “max”, terwijl de rekening wel flink hoger werd. De verklaring: op de hoogste standen bouwt het model complexere oplossingen die vaker fouten bevatten, en herschrijft het code die je niet gevraagd had aan te passen. Anthropic zelf raadt in zijn handleiding aan om “low” en “medium” ruim te gebruiken. Ook de tijd loopt op: op de hoogste stand doet het model volgens Artificial Analysis meer dan 36 minuten over één kantoortaak, tegen 24 minuten bij de voorganger.
Eén waarschuwing komt niet van de leverancier maar van de vakpers: tokenprijzen zeggen niet alles. Bij een eerdere generatie bleek Opus 4.7 uiteindelijk 30 tot 40 procent duurder per taak dan Opus 4.6, hoewel de tarieven identiek waren, simpelweg omdat het model meer tokens verbruikte. Bij Opus 5 lijkt dat mee te vallen: de gemiddelde testtaak kostte 2,03 dollar, minder dan bij Fable 5 (2,75 dollar), maar meer dan bij Opus 4.8 (1,80 dollar) en Sonnet 5 (1,53 dollar).
Kan je dit gebruiken met gegevens die in Europa moeten blijven?
Ja, dat kan, en dat is voor Vlaamse bedrijven het praktisch relevantste nieuws. Opus 5 is vanaf dag één beschikbaar via Amazon Bedrock, het AI-platform van AWS, onder meer in datacenters in Ierland en Zweden. AWS zegt dat er op Bedrock standaard geen gegevens bewaard worden en dat medewerkers van AWS geen toegang hebben tot je verwerkingen. Dat is een claim van de leverancier zelf; de bronnen bevatten geen onafhankelijke controle daarvan.
Ook bij Anthropic zelf blijft Opus 5, net als zijn voorganger, buiten de regel die gegevens dertig dagen bewaart en die wél geldt voor Fable 5 en Mythos 5. Dat verschil lag eerder al gevoelig bij privacybewuste gebruikers.
Verder verzachtte Anthropic de veiligheidsfilters rond computerbeveiliging. Volgens het bedrijf slaan die bij Opus 5 ongeveer 85 procent minder vaak aan dan bij Fable 5, waar de frequente blokkades veel kritiek kregen. Wordt een vraag toch geweigerd, dan valt het systeem terug op Opus 4.8. Voor ontwikkelaars is er een testversie van die automatische terugval, zodat je een werkend antwoord krijgt in plaats van een foutmelding.
Tot slot, en dat gaat eerder over dagelijks gebruik dan over benchmarks: Anthropic zette gelijktijdig zijn spraakmodus open voor de zwaardere modellen, waar die eerder alleen met het lichtste model Haiku werkte. Je kan tijdens een gesprek van model wisselen, in de mobiele app, de desktopversie en de webchat, en het model kan aangesloten diensten zoals Gmail, Google Agenda, Slack en Canva bedienen, bijvoorbeeld om een e-mail in te spreken en te versturen. De spraakmodus ondersteunt elf talen; welke dat precies zijn, staat niet in de bronnen.
Wat betekent dit voor jou
Wat dit verandert voor je AI-budget en je nazicht
- Kmo's die AI-teksten of analyses naar klanten sturen Het model is slimmer, maar losser met feiten: het hallucinatiecijfer ligt op 50 procent. Bouw een vaste controlestap in voor alles wat je huis verlaat, en gebruik het liever om te structureren dan om cijfers of namen uit het hoofd te leveren.
- Wie AI-kosten opvolgt per project of per klant Kijk naar de kost per afgewerkte taak, niet naar de tokenprijs. Een kantoortaak kost op de hoogste stand 17,79 dollar tegen 10,41 dollar op de stand eronder, met een beter resultaat. De standaardstand laten staan is hier vaak goedkoper én beter.
- Bedrijven die vandaag Claude Pro of Max gebruiken Je hoeft niets te doen. Opus 5 wordt automatisch de standaard in Max en het sterkste beschikbare model in Pro, aan dezelfde abonnementsvoorwaarden. Alleen wie via een eigen koppeling of via AWS werkt, moet actief kiezen welk model en welke rekenstand die inzet.
Veelgestelde vragen
Wat kost Claude Opus 5 per miljoen tokens?
Je betaalt vijf dollar voor een miljoen tokens die je erin stopt en 25 dollar voor een miljoen tokens die eruit komen. Dat is hetzelfde tarief als bij Opus 4.8 en half zo veel als bij Fable 5. Hergebruik van eerder verwerkte tekst kost 0,50 dollar per miljoen. Fast Mode verdubbelt het tarief voor ongeveer 2,5 keer meer snelheid.
Is Claude Opus 5 nu het beste AI-model?
Volgens Artificial Analysis wel, met 61 punten op zijn Intelligence Index, net voor Fable 5 en GPT-5.6 Sol. Epoch AI zet het net achter Fable 5, met GPT-5.6 Sol bovenaan. De verschillen tussen de topmodellen zijn dus klein, en welk model het beste is, hangt af van de taak die je ermee doet.
Moet ik de hoogste rekenstand kiezen voor het beste resultaat?
Nee. Onafhankelijke tests van Vals.ai laten zien dat de stand "high" bij programmeertaken beter presteert dan "xhigh" en "max", terwijl die hoogste standen duurder zijn en langer duren. Op de hoogste standen bouwt het model complexere oplossingen met meer fouten. Anthropic raadt zelf aan om "low" en "medium" ruim te gebruiken.
Blijven mijn gegevens binnen Europa als ik Claude Opus 5 gebruik?
Dat kan, als je het model afneemt via Amazon Bedrock, dat het aanbiedt in datacenters in onder meer Ierland en Zweden. AWS stelt dat er standaard geen gegevens bewaard worden. Bij Anthropic zelf valt Opus 5 buiten de regel die gegevens dertig dagen bijhoudt en die wel geldt voor Fable 5 en Mythos 5.
Hoe betrouwbaar zijn de antwoorden van Claude Opus 5?
Minder betrouwbaar dan de prestatiescores laten uitschijnen. De helft van de gemeten antwoorden bevat volgens testhuis Artificial Analysis een verzinsel, een stijging van veertien punten tegenover Opus 4.8, omdat het model minder snel toegeeft dat het iets niet weet. Op feitenkennis blijft het achter op Fable 5. Laat publicaties dus altijd nakijken.
Werkt de spraakmodus van Claude in het Nederlands?
De bronnen zeggen dat de vernieuwde spraakmodus elf talen ondersteunt, maar noemen niet welke. Nieuw is dat de modus ook op de zwaardere modellen Opus en Sonnet werkt, dat je tijdens een gesprek van model kan wisselen, en dat je via spraak diensten zoals Gmail, Google Agenda, Slack en Canva kan bedienen.
Bronnen
- AWS Machine LearningIntroducing Claude Opus 5 on AWS: Anthropic’s most capable Opus model24 jul, 17:59
- Simon WillisonIntroducing Claude Opus 524 jul, 23:48
- TechCrunchAnthropic launches Opus 524 jul, 17:00
- The DecoderAnthropic s Claude Opus 5 delivers near-Fable 5 performance at half the token price25 jul, 10:04
- The DecoderAnthropic s Claude Opus 5 costs well below Fable 5 while matching or beating it across most benchmarks25 jul, 09:31
- The DecoderClaude s voice mode now runs on Anthropic s most capable models across all platforms24 jul, 11:31
- TweakersClaude Opus 5 is uit en presteert zoals Fable 5 voor half de tokenkosten24 jul, 19:09
- AnthropicIntroducing Claude Opus 524 jul, 00:00
- The VergeAnthropic releases Opus 5 with ‘close’ to Fable 5’s capabilitiesbetaalmuur24 jul, 17:00
- The VergeClaude’s voice mode is now available for Opus and Sonnetbetaalmuur23 jul, 19:00