Ik heb ChatGPT-6 vergeleken met Claude Opus 5.5 met 5 dagelijkse claims: het verschil was enorm.
Ontdek de winnaar: een overtuigende vergelijking tussen ChatGPT-6 en Claude Opus 5.5 in 5 dagelijkse taken. De ene presteerde duidelijk beter dan de andere, en het verschil was enorm!
De belangrijkste dingen die je moet weten
- Claude blinkt uit in het grondig begrijpen van complexe claims, het anticiperen op ongeoorloofde behoeften (zoals kruisbesmetting bij de planning van feesten) en het leveren van geïntegreerde, intelligente oplossingen.
- Claude toonde een opmerkelijk vermogen om problemen vanuit een ander perspectief te bekijken, met de nadruk op concrete menselijke voordelen en inzicht in de onderliggende motivaties, wat getuigt van een diepere strategische aanpak.
- Ondanks dat Claude meer diepgang bood, was de rechtstreekse, stapsgewijze aanpak van ChatGPT effectiever in het bieden van praktische en directe oplossingen voor verwarrende situaties, zoals het organiseren van een druk dagelijks leven.
OpenAI en Anthropic hebben deze maand allebei twee baanbrekende nieuwe AI-modellen uitgebracht: ChatGPT-6 en Claude Opus 5.5. Beide modellen beschikken over zulke immense mogelijkheden dat ze veel meer bieden dan de meeste gebruikers ervan zouden verwachten.
De GPT-6-familie van OpenAI is gebaseerd op de GPT-6 Astra, het meest indrukwekkende model van het bedrijf tot nu toe, dat aanzienlijke vooruitgang heeft geboekt op gebieden zoals inferentie, professioneel werk, programmeren, internetten en computergebruik. De nieuwere GPT-6 Sol brengt veel van die intelligentie naar de versie die is ontworpen voor dagelijks gebruik, waardoor het een sneller en kosteneffectiever inferentiemodel is.

Claude Opus 5.5 pakt het probleem vanuit een iets andere invalshoek aan. Anthropic beschrijft het als een model dat is ontworpen voor langdurig, cognitief, agentgebaseerd werk, met adaptief redeneren dat de benodigde inspanning voor een verzoek bepaalt. Het beschikt over een contextvenster van maximaal één miljoen tokens en kan tot 128,000 token-outputs produceren. Volgens Anthropic presteert het op de meeste taken bijna net zo goed als hun topmodel, Claude Fable 5.1, terwijl de gebruikskosten 40% lager liggen dan bij de vorige Opus-versie. Anthropic benadrukte ook de verbeteringen in de manier waarop het model op een natuurlijke manier communiceert en schrijfinstructies opvolgt.
Deze verschillen lijken indrukwekkend, maar ze vertellen je niet per se welke chatbot je het liefst zou gebruiken in je dagelijks leven. Voor meer praktische vergelijkingen kun je ons artikel bekijken: Ik heb Claude 4 Sonnet getest tegen ChatGPT-4o in 7 taken: één van beide presteerde aanzienlijk beter dan de andere.
Daarom legde ik ChatGPT-6 en Claude Opus 5.5 exact dezelfde vijf eisen voor. Het resultaat was niet de klinkende overwinning die ik verwachtte. Dit is wat er gebeurde toen ik ze aan alledaagse eisen onderwierp.
1. Complexe realistische planning — beperkingen + schatting

Opdracht: Ik heb $150 om een verjaardagsfeest te organiseren voor 10 kinderen van 8 tot 11 jaar. Het feest moet drie uur duren, binnen plaatsvinden (voor het geval het regent), eten bevatten en de schermtijd minimaliseren. Twee van de kinderen zijn veganistisch en één heeft een pinda-allergie. Maak een compleet plan, inclusief budget, tijdschema, activiteiten en een alternatief plan. Het budget mag niet meer dan $150 bedragen.
ChatGPT bood een helder conceptueel kader door het evenement een identiteit en directe richting te geven. Het is voor een ouder met tien kinderen praktisch makkelijker om $36 uit te geven aan drie afhaalpizza's met kaas dan om zelf minipizza's te maken in een doorsnee keuken. Het voorzag ook in de behoefte aan een "noodreserve/prijs" aan het einde.
Claude was zeer bedreven in het anticiperen op allergieën en voedselprotocollen. Hij pakte ook het probleem van kruisbesmetting tussen gebak en kant-en-klare mixen aan. Hij toonde budgetbewust handelen door $14 te reserveren voor draagtassen en $12 voor textielstiften, die zowel als knutselactiviteit bij aankomst als als bedankje dienden, waardoor geld werd bespaard en de hoeveelheid goedkoop plastic afval werd verminderd. Hij leverde bovendien een praktische en concrete planning en oplossingen voor operationele problemen. Dit vermogen om een alomvattend en intelligent plan te presenteren, maakt Claude voor velen een favoriete keuze, zoals uitgelegd in het artikel "6 redenen waarom ik Claude gebruik in plaats van ChatGPT ".
Winnaar: Claude wint omdat hij een compleet, kant-en-klaar plan voor de gastheer heeft opgesteld, met oprechte aandacht voor de veiligheid, terwijl ChatGPT een onsamenhangend boodschappenlijstje heeft aangeleverd.
2. Schrijven — Zorg dat AI menselijk klinkt

De opdracht: Herschrijf deze saaie advertentie tot iets wat een echt persoon wél zou willen lezen. Behoud alle feitelijke details, gebruik geen gedachtestreepjes, vermijd clichés en vermijd woorden als 'spannend', 'revolutionair', 'baanbrekend' of 'naadloos'.
“Ons bedrijf introduceert een nieuwe, door AI aangedreven agendafunctie die automatisch planningsconflicten identificeert, vergadertijden aanbeveelt en na afloop van vergaderingen een samenvatting maakt. De functie wordt gelanceerd op 15 oktober en is dan zonder extra kosten beschikbaar voor al onze klanten.”
ChatGPT leverde een pakkende openingszin die de lezer direct aantrok, waarbij typische AI-technieken werden vermeden en realistische details behouden bleven. De alinea-indeling maakte de tekst gemakkelijk en snel te scannen.
Claude herformuleerde de kernpunten tot tastbare menselijke voordelen en herformuleerde de details om de nadruk te leggen op de daadwerkelijke vermindering van de werkdruk.
Winnaar: Claude wint omdat het erkende dat "menselijk" parafraseren een heroverweging vereist van hoe kenmerken worden uitgelegd, in plaats van simpelweg enkele werkwoorden in de originele tekst te veranderen. Dit sluit aan bij de ene bewering die een significant verschil maakt bij dagelijks gebruik van Claude.
3. Redenering — Het antwoord is niet duidelijk

Het probleem: Een gezin moet kiezen tussen twee vakantiehuizen. Het eerste kost $1,850 en ligt op 10 minuten lopen van het strand. Het tweede kost $1,500, maar is 25 minuten rijden naar het strand, plus $35 per dag voor parkeren. Het gezin blijft zeven dagen en verwacht twee keer per dag naar het strand te gaan. Ze hebben drie kinderen. Welke optie moeten ze kiezen? Kijk niet alleen naar de kosten. Identificeer factoren die uw aanbeveling kunnen beïnvloeden en geef aan welke aanvullende informatie het belangrijkst is.
ChatGPT bood het beste tegenargument met betrekking tot de leeftijden van de kinderen. Het wees er ook scherpzinnig op dat een "10 minuten lopen" aanzienlijk kan variëren, afhankelijk van de omringende infrastructuur (is het een houten vlonder, een vierbaansweg of een zandduin?). De chatbot merkte specifiek op dat het eerste huis ouders de mogelijkheid biedt om taken te verdelen (bijvoorbeeld, de ene ouder kan een moe kind naar huis brengen terwijl de andere ouder met de andere twee op het strand blijft).
Claude berekende de afstand nauwkeurig en toonde aan dat de financiële besparing van een tweede huis in werkelijkheid slechts $55 tot $65 bedraagt voor de hele week. Hij maakte ook een scherpzinnige psychologische opmerking: het vier keer per dag in- en uitladen van drie kinderen in autostoeltjes betekent dat het gezin waarschijnlijk hun tweede dagelijkse stranduitstapje helemaal zal overslaan. Hij wees ook terecht op het "vuile geheim" van platforms voor vakantieverhuur: de basisprijzen zijn exclusief schoonmaakkosten, servicekosten of toeristenbelasting, wat alleen al een verschil van $105 kan opleveren.
Winnaar: Claude won nipt. Hoewel ChatGPT het beste individuele punt maakte (inzien dat lopen met zware strandspullen en jonge kinderen vermoeiender kan zijn dan autorijden), won Claude overall omdat zijn financiële analyse zo grondig en accuraat was, hij verborgen kosten voorzag en zijn observatie dat woon-werkverkeer ertoe zou leiden dat het gezin hun geplande uitjes zou moeten afzeggen, absoluut raak was. Ontdek 6 redenen waarom ik Claude zou gebruiken in plaats van ChatGPT.
4. Meerdere opties — hoe bepalen we wat het belangrijkst is?

De bewering: Een stad heeft een budget van 10 miljoen dollar en staat voor drie opties:
a) De bouw van een nieuwe openbare bibliotheek die naar verwachting gedurende minstens 30 jaar jaarlijks 200,000 bezoekers zal trekken.
b) Het toekennen van een eenmalige betaling van $500 aan elk gezin.
c) Het moderniseren van de verouderde waterinfrastructuur, iets wat bewoners pas zullen merken als er iets misgaat.
De stad kan slechts één optie kiezen. Selecteer de optie die u het beste vindt. Leg uw redenering uit, geef het sterkste argument tegen uw keuze aan en leg uit welke aanvullende informatie uw antwoord waarschijnlijk zou veranderen. Ontwijk de vraag niet door te zeggen dat alle opties goed zijn.
ChatGPT heeft alle instructies nauwgezet opgevolgd en een gemakkelijk leesbare onderbouwing van optie C gegeven. Ook is de drempel voor de technische evaluatie duidelijk gedefinieerd.
Claude baseerde zijn keuze op gemeentelijke stimuleringsmaatregelen en besefte dat het financieren van zaken die door de verkiezingspolitiek worden genegeerd, de primaire taak van het stadsbestuur is.
Winnaar: Claude wint omdat hij een veel beter antwoord gaf. De bot leek expertise te hebben op het gebied van openbaar financieel beheer, terwijl het antwoord van ChatGPT meer formulematig en oppervlakkig overkwam.
5. De doorslaggevende test: een vaag verzoek + initiatief.

Het verzoek: Ik heb het gevoel dat mijn leven chaotisch is. Ik heb drie kinderen, een fulltime baan, huishoudelijke taken en ongeveer 30 minuten per avond om de zaken op orde te krijgen. Ontwikkel een systeem dat ik realistisch kan volhouden. Geef me geen algemene productiviteitstips. Ga waar nodig uit van redelijke aannames, leg uit welke aannames je maakt en geef me iets waarmee ik vanavond al aan de slag kan.
ChatGPT bood eenvoudige manieren om burn-out te voorkomen, inclusief instructies die in stappen waren opgedeeld, zodat de gebruiker niet hoefde te plannen of te gissen waar te beginnen.
Claude ging in op de mentale belasting en bood een scherp en inzichtelijk begrip van de oorzaak van de chaos. Hij gaf ook het nuttige advies om haalbare huishoudelijke taken te delegeren, omdat hij erkende dat één ouder niet de enige drijvende kracht kan zijn in een gezin van vijf.
Winnaar: ChatGPT wint omdat het cognitieve raamwerk de mentale ruimte van de uitgeputte ouder beter beschermt. Claude bood een goede routine voor de huishoudelijke organisatie, terwijl ChatGPT een filter voor besluitvorming bood dat voorkomt dat werk, gezin en privéleven elkaar daadwerkelijk kapotmaken.
Algemene winnaar: Claude
Na vijf tests presteerde Claude Opus 5.5 in vier daarvan beter. Maar wat me verbaasde, was hoe consistent het verschil tussen deze modellen bleef bestaan bij volledig ongerelateerde taken. Claude lijkt de diepte in te gaan.
Toen ik hem vroeg een verjaardagsfeest te plannen, hield hij rekening met kruisbesmetting en vond hij manieren om een feest te organiseren dat twee doelen diende. Toen ik het onderwerp vakantiewoningen ter sprake bracht, berekende hij de kosten die ik niet expliciet had genoemd en overwoog hij of het ongemak van het autorijden het gedrag van het gezin daadwerkelijk zou veranderen. Zelfs bij het bepalen van de besteding van een stad van 10 miljoen dollar keek hij verder dan de voor de hand liggende voor- en nadelen en vroeg hij zich af waarom overheden deze beslissingen überhaupt nemen.
Precies op dit punt toonde Claude Opus 5.5 zijn grootste kracht. ChatGPT-6 was daarentegen over het algemeen gestroomlijnder, wat perfect aansluit bij de gevestigde aard van ChatGPT. ChatGPT, ongeacht het model, geeft doorgaans beknoptere en minder omslachtige antwoorden en komt sneller ter zake. Dit betekent echter ook dat de antwoorden niet altijd even inzichtelijk waren als die van Claude, wat verklaart waarom sommige gebruikers voor bepaalde taken de voorkeur geven aan Claude. Lees meer over de overtuigende redenen waarom u Claude boven ChatGPT-5 zou kunnen verkiezen . Desondanks bleek deze aanpak (de directe stijl van ChatGPT) een voordeel te zijn tijdens mijn recente tests.
Reacties zijn gesloten.