Claude Opus 5.5, GPT-6 Sol en Grok 4.7: drie releases in twee dagen en welk model je kiest
In twee dagen eind september verschenen drie grote releases: Grok 4.7 van xAI, Claude Opus 5.5 van Anthropic en OpenAI's GPT-6 Sol en Luna. Dit is een heldere blik op hoe ze verschillen, waar elk model echt in uitblinkt en welk je kiest voor jouw taak. Alle vier zijn al beschikbaar in ChatPlus.

Op 21 september bracht xAI Grok 4.7 uit. Een dag later onthulde Anthropic Claude Opus 5.5, terwijl OpenAI GPT-6 Sol en GPT-6 Luna lanceerde. Drie labs, vier modellen, twee dagen. Toeval kun je dat moeilijk noemen: de race is zo spannend dat niemand een concurrent zelfs maar een week alleen in de spotlights wil laten staan.
De korte versie: Opus 5.5 is de sterkste van de nieuwe releases en volgens onafhankelijke metingen op dit moment het beste model op de markt in het algemeen. GPT-6 Sol is nauwelijks slimmer geworden in ruwe intelligentie, maar kost half zoveel en maakt minder feitelijke fouten. Luna is lichtgewicht en erg betaalbaar. Grok 4.7 is een grote stap vooruit voor xAI, maar zit voorlopig nog in de tweede divisie, al is de prijs aantrekkelijk. Dit zijn de details, inclusief de eerlijke kanttekeningen bij elk model.
Vier modellen in één oogopslag
Ter referentie staan hieronder de belangrijkste specificaties. Prijzen zijn per miljoen API-tokens, zodat je kunt zien welke modellen duur zijn; ChatPlus rekent niet apart af per token, omdat alles in het abonnement is inbegrepen.
| Model | Ontwikkelaar | Input / output, $ | Context | Beste in |
|---|---|---|---|---|
| Claude Opus 5.5 | Anthropic | 4 / 20 | 1M | Lange codeertaken, documenten, helder schrijven |
| GPT-6 Sol | OpenAI | 2 / 10 | 1.05M | Code, agents, feitelijke nauwkeurigheid |
| GPT-6 Luna | OpenAI | 0.10 / 0.50 | 1.05M | Snelle, eenvoudige taken |
| Grok 4.7 | xAI | 2 / 6 | 500K | Code, engineering, recht |
Claude Opus 5.5: prestaties op Fable-niveau zonder de flagship-prijs
Opus 5.5 trapt de nieuwe Claude 5.5-familie af. Anthropic vat het grootste voordeel in één zin samen: het model presteert op het niveau van Claude Fable 5.1 — het krachtigste en duurste model van het bedrijf — maar kost 40% minder dan Opus 5. Tokenprijzen zijn 20% lager, en de rest komt uit efficiëntie: het model gebruikt minder stappen en minder tokens voor dezelfde taak. Het genereert ook meer dan 30% sneller tekst dan zijn voorganger.
Onafhankelijke tests bevestigen dat. In de aggregate index van Artificial Analysis haalde Opus 5.5 58 punten op maximale instellingen — het beste resultaat dat daar ooit is gemeten, met een voorsprong van meerdere punten. Het staat vrijwel overal bovenaan: agentic programming (66.4% op Terminal-Bench 4.0 tegenover 55.8% voor Fable 5.1 en 57.9% voor GPT-6 Astra), kantoorwerk en complexe vragen met toolgebruik.
Maar benchmarkcijfers zeggen weinig over hoe een model aanvoelt in echt werk. Verhalen van vroege testers zeggen meer. Eén tester migreerde in minder dan een dag een project met 680.000 regels code, een taak waar een engineeringteam normaal weken voor nodig zou hebben. Een ander auditte en repareerde een codebase van 200.000 regels in drie uur, terwijl Opus 5 voor hetzelfde werk meer dan twintig uur nodig had. Bij een ander bedrijf rondde Opus 5.5 een complexe taak die eerder 38 prompts en vier dagen kostte af in 11 prompts en drie uur. Anthropic deed ook een intern experiment: het vroeg Opus 5.5 en Fable 5.1 om HAProxy, een populaire load balancer, van C naar Rust te herschrijven. Beide slaagden, maar Opus 5.5 was klaar in 9,5 uur in plaats van 12 en kostte half zoveel.
De tweede grote verandering zit in de schrijfstijl. Opus 5 kreeg vaak kritiek omdat het breedsprakig was: lange inleidingen, corporate formuleringen en de kern pas in de derde alinea. Opus 5.5 zet de hoofdboodschap eerst, vervalt minder snel in jargon en volgt de stijlregels die je meegeeft betrouwbaarder. Een tester vatte het simpel samen: "Het schrijft zoals ik schrijf." Dat merk je meteen wanneer je met tekst werkt: je hoeft achteraf minder op te ruimen.
Er is één eigenschap die je vooraf moet weten: je kunt reasoning in Opus 5.5 niet uitzetten. Het denkt altijd eerst en antwoordt daarna. Dat is een voordeel bij complexe taken. Bij een vraag als "wat is het Engelse woord voor vensterbank?" betekent het een paar seconden extra wachten. Voor zulke kleine taken is een eenvoudiger model een betere keuze.
In ChatPlus is Claude Opus 5.5 al beschikbaar in chat — op het Max-abonnement, naast andere topmodellen.
GPT-6 Sol: dezelfde lat, voor de helft van de prijs
Begin september bracht OpenAI zijn flagship GPT-6 Astra uit, en de GPT-6-familie ziet er nu zo uit: Astra bovenaan, Sol in het midden, Luna onderaan. Sol is bedoeld als werkpaard: het neemt Astra's precisie en vermogen om een taak tot het einde af te maken over, maar kost aanzienlijk minder.
OpenAI verkoopt Sol op betrouwbaarheid, niet op records. Het bedrijf nam echte gesprekken waarin gebruikers modelfouten hadden gemeld en testte de nieuwe versie daarop: Sol maakt ongeveer half zo vaak fouten als GPT-5.6 Sol en bereikt Astra-niveau qua betrouwbaarheid. Een onafhankelijke hallucinatietest bevestigt dit, met een kanttekening. Het aandeel verzonnen antwoorden daalde van 92% naar 60%, vooral doordat het model vaker weigert te antwoorden wanneer het onzeker is. Het totale aandeel correcte antwoorden daalde zelfs licht, van 59% naar 54%. Voor dagelijks werk is dat eerder goed nieuws dan slecht: een eerlijk "ik weet het niet" is beter dan een zelfverzekerd verzinsel.
Bij programmeren houdt Sol gelijke tred met veel duurdere modellen. Op DeepSWE, een test voor lange engineeringtaken in echte repositories, scoort het 68.8%. Claude Fable 5 heeft de beste score met 69.9%, maar kost per taak ongeveer vijf keer zoveel. Op Terminal-Bench 4.0 verbeterde Sol van 37% naar 43%.
Nu wat het persbericht niet noemt. In de aggregate intelligence index is Sol bijna onveranderd ten opzichte van zijn voorganger: 48 punten tegenover 47. Het is zelfs achteruitgegaan in werk met kantoordocumenten en blijft achter bij zowel Astra als de vorige Sol in computerbesturing. Dit is dus geen sprong vooruit, maar dezelfde capaciteitslat voor de helft van de prijs. Voor de meeste taken is dat precies wat je nodig hebt: coderen, onderzoek, correspondentie en analyses. Als je een model nodig hebt dat zelfstandig door interfaces klikt, kies dan Astra.
GPT-6 Sol is beschikbaar in ons PRO-abonnement, en omdat het half zoveel kost als de vorige Sol, gaat je tegoed merkbaar langer mee in lange gesprekken. Open een chat met GPT-6 Sol.
GPT-6 Luna: het kleinere model met de meest verse kennis
OpenAI beschrijft Luna eenvoudig: een model voor grote volumes taken met een duidelijk doel. Een document samenvatten, getallen en namen uit tekst halen, snel een vraag beantwoorden. Daar is niets bescheidens aan: dit zijn de taken die het grootste deel vormen van wat mensen dagelijks met AI doen.
De prijs is bijna symbolisch: tien cent per miljoen inputtokens en vijftig cent per miljoen outputtokens. Dat is de helft van de inputprijs van GPT-5.6 Luna en bijna tweeënhalf keer goedkoper op output. In de aggregate intelligence index blijft het model op het niveau van zijn voorganger. Het zakte iets in agentic coding, maar op DeepSWE op maximale instellingen haalt het 66.6% voor slechts 22 cent per taak. Volgens OpenAI is dat vergelijkbaar met Claude Opus 5 en Fable 5 op medium-instellingen, terwijl het 93–96% minder kost.
Een interessant detail: het kleinste model in de familie heeft de meest recente kennis. Luna is getraind op data tot en met mei 2026, terwijl Sol en Astra stoppen bij april.
In ChatPlus is GPT-6 Luna beschikbaar in het PRO-abonnement en gebruikt het je tegoed niet — de limiet van 5 uur waarvan verzoeken aan dure modellen worden afgetrokken. Je kunt het zo veel gebruiken als je wilt zonder op de teller te letten. Het is niet de beste keuze voor complexe code over meerdere bestanden, maar je kunt in hetzelfde gesprek overschakelen naar Sol of Opus.
Grok 4.7: groot, laat en verrassend betaalbaar
Grok 4.7 verscheen eerder dan de andere modellen, ondanks dat er het langst naar werd uitgekeken: Elon Musk stelde de release minstens vijf keer uit, vanaf eind juli. Die vertraging is begrijpelijk. Dit is geen cosmetische update, maar een nieuw en aanzienlijk groter basismodel: volgens mediaberichten rond de 2,1 biljoen parameters. Het kreeg langere reinforcement learning-training, met de nadruk op taken waar mensen uren over doen. xAI verbeterde ook de zelfcontrole: het model beoordeelt zijn eigen antwoorden zorgvuldiger en gaat beter om met lange context. Overigens noemt het bedrijf zichzelf in officieel materiaal nu SpaceXAI, al heten de modellen nog steeds Grok.
De verbetering ten opzichte van Grok 4.6 is fors. Op CursorBench 4.0, een test voor lange programmeertaken, steeg de score van 40.4% naar 46.3%. Op Terminal-Bench 4.0 verdubbelde die bijna, van 20.3% naar 37.6%. Bij kantoorwerk dat meerdere uren kost — rapporten, spreadsheets, presentaties — won het model meer dan honderd Elo-punten. De juridische prestaties zijn vooral verrassend: op de juridische benchmark Harvey scoort Grok 4.7 19.6%, bijna drie keer de 6.7% van Claude Fable 5.1. Op de elektrotechnische benchmark EEBench haalt het 64% tegenover Fable's 56.4%.
Zijn plek in de algemene ranglijsten is bescheidener. In de meeste vergelijkingen staat Grok 4.7 tweede: het blijft achter bij Fable 5.1 in kantoorwerk, bij GPT-6 Astra in engineeringtaken en ligt nog ver achter Opus 5.5. Onafhankelijke tests zetten het op 46 punten in de intelligence index. Dat was genoeg voor xAI om de top vier labs binnen te komen, maar niet verder. Musk zelf belooft "Astra and Fable class" pas met Grok 4.9. Nog een kanttekening: op maximale instellingen gebruikt het model meer dan twee keer zoveel tokens per taak als Grok 4.6, dus dezelfde tokenprijs betekent niet dezelfde kosten per resultaat.
Het belangrijkste voordeel van Grok 4.7 is de prijs-kwaliteitverhouding. Het kost hetzelfde als Grok 4.6 — twee dollar per miljoen inputtokens en zes per miljoen outputtokens — en is duidelijk goedkoper dan de flagships van Anthropic en OpenAI. Grok 4.7 is beschikbaar in ChatPlus met het PRO-abonnement.
Dus welke moet je kiezen?
Wij zouden het zo indelen.
Als de taak groot en belangrijk is — complexe code, een projectaudit, een analytisch rapport of een lang document dat helder denkwerk vraagt — kies dan Claude Opus 5.5. Het is op dit moment het sterkste beschikbare model en het schrijft merkbaar beter dan eerdere Claude-modellen.
Voor dagelijks werk waarbij je balans nodig hebt, is GPT-6 Sol een uitstekende keuze: code, research, e-mails en spreadsheets. Het is voorzichtig, hallucineert minder vaak en gebruikt minder van je tegoed.
Voor kleine taken zoals samenvattingen, vertalingen, korte naslagantwoorden en concepten kies je GPT-6 Luna. Het is snel en gebruikt je tegoed helemaal niet.
Grok 4.7 is het proberen waard voor juridische en technische vragen, waar het onverwacht sterk is, en als second opinion wanneer je het antwoord van een ander model wilt vergelijken.
De makkelijkste manier om te vergelijken is op je eigen taak. In ChatPlus kun je midden in een gesprek van model wisselen: stel Opus een vraag, schakel over naar Sol of Grok, stuur dezelfde prompt opnieuw en zie meteen wie het het beste aanpakt. Gedetailleerde modelpagina’s zijn beschikbaar voor Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna en Grok 4.7.
In het kort
Vier nieuwe modellen verschenen in twee dagen. Claude Opus 5.5 is de nieuwe koploper: capaciteiten op Fable 5.1-niveau voor 40% minder dan Opus 5, de beste agentic coding in zijn klasse en merkbaar helderder schrijfwerk. GPT-6 Sol is nauwelijks slimmer geworden, maar kost half zoveel en maakt half zo vaak feitelijke fouten. GPT-6 Luna is een heel betaalbaar model voor eenvoudige taken met de meest verse kennis in de familie. Grok 4.7 heeft een grote sprong vooruit gemaakt, vooral in code, recht en engineering, maar blijft voorlopig in de tweede divisie — tegen een toegankelijke prijs. Alle vier zijn al beschikbaar in ChatPlus.
Probeer de beste AI-modellen op ChatPlus
GPT, Claude, Gemini, GLM en andere AI-modellen in één venster.