
Bij dezelfde opdracht in 3D, een zeilende vissersboot in een nachtelijke storm, levert Claude Opus 5.5 in Claude Code de meest getrouwe scène, maar in bijna 39 minuten en voor ongeveer 6,96 $ tegen het API-tarief. GPT-6 Sol in Codex voldoet ook aan de dertien punten van de opdracht in 5 minuten voor ongeveer 0,29 $, met een helderdere en minder onstuimige scène. Beide scènes draaien in het artikel.
Op 22 september 2026 bracht Anthropic Claude Opus 5.5 uit en OpenAI GPT-6 Sol, dezelfde dag nog. Diezelfde avond gaf ik beide modellen de opdracht van ons eerste duel: een zeilende vissersboot, gevangen in een nachtelijke storm, in 3D, op één simpele webpagina.
Elk model werkt binnen de programmeerassistent van zijn maker: Claude Code voor Opus 5.5 en Codex voor GPT-6 Sol. Die assistenten doen meer dan alleen antwoorden in een chatvenster. Ze schrijven bestanden op de computer, voeren commando’s uit en lezen hun eigen werk na. De twee opgeleverde scènes draaien hieronder, in je browser. Klik op “Alles uitvoeren”, of open volledig scherm om ze naast elkaar te bekijken.
Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.
Gedeelde prompt
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).
Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.
Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protocol
La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.
Draait in een geïsoleerde sandbox (iframe sandbox en CSP): geen toegang tot de site, cookies of je sessie. Er wordt niets geladen voordat je klikt.
Draait in een geïsoleerde sandbox (iframe sandbox en CSP): geen toegang tot de site, cookies of je sessie. Er wordt niets geladen voordat je klikt.
| Metingen | A · Claude Code · Claude Opus 5.5 | B · Codex · GPT-6 Sol |
|---|---|---|
| Temps de travail | 38 min 39 s | 5 min 03 s |
| Coût au tarif public de l'API | ≈ 6,96 $ | ≈ 0,29 $ |
| Points de la consigne respectés | 13 sur 13 | 13 sur 13 |
| Erreurs au chargement | 0 | 0 |
| Poids de la page | 42 Ko | 20 Ko |
| Bateau | bateau de pêche à deux mâts, voiles tannées | voilier de plaisance à un mât |
| Lanternes | 4, dont 3 qui se balancent | 3 |
| Images par seconde sans carte graphique (rendu logiciel, sans limite) | 16 | 36 |
| Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite) | 753 | 327 |
Oordeel
Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.
Twee modellen op dezelfde dag uitgebracht
Anthropic presenteert Claude Opus 5.5 als een model van het niveau van Claude Fable 5.1 voor de meeste taken, 40% goedkoper om te draaien dan Opus 5. De aankondiging van 22 september citeert zelfs een tester die door meerdere Claude-modellen op basis van één opdracht een spel liet bouwen: Opus 5.5 kreeg de beste beoordeling voor de graphics en de afwerking.
Bij OpenAI bouwt GPT-6 Sol voort op de vooruitgang van GPT-6 Astra, in een model dat sneller en goedkoper is. De aankondiging van 22 september op het ontwikkelaarsforum van OpenAI maakt het model beschikbaar in Codex voor de abonnementen Plus, Pro, Business, Enterprise en Edu, met API-prijzen die gehalveerd zijn ten opzichte van de actietarieven van GPT-5.6. 9to5Mac omschrijft het als het model voor complexe programmeertaken, tegenover GPT-6 Luna, bedoeld voor gerichtere taken die in groot volume worden herhaald.
De opdracht, woord voor woord die van het eerste duel
De opdracht past op één pagina. Ze vraagt om een scène in three.js, een gratis bibliotheek waarmee je 3D tekent op een webpagina, geleverd in één enkel bestand dat in elke browser opent. Het onderwerp: een zeilende vissersboot die ’s nachts op een woelige zee vaart, midden in een storm.
Daarna volgen dertien eisen. Een zee die beweegt, schuim op de golftoppen, een pikzwarte nacht, lage wolken, regen die door de wind wordt voortgejaagd en bliksem op onregelmatige tussenpozen. Een boot die uitsluitend is opgebouwd uit basisvormen (kubussen, cilinders, bollen), die stampt en rolt met de golven mee, en minstens drie lantaarns met flakkerend licht. Ten slotte een camera die je met de muis kunt draaien, een venster dat je kunt vergroten of verkleinen, een kort hulptekstje en één enkel bestand. De volledige opdracht is te lezen in de test, onder “Gedeelde prompt”.
Dezelfde instelling, dezelfde sandbox, één enkele poging
Op 7 september zette onze eerste vergelijking van Claude Code en Codex Claude Fable 5.1 en GPT-6 Astra tegenover elkaar met exact dezelfde opdracht. Ik nam de regels daarvan over: één enkele poging, geen enkele aanpassing achteraf, en aan beide kanten hetzelfde denkniveau, “xhigh”.
Die instelling bepaalt hoeveel tijd de AI mag besteden aan nadenken, voor en tijdens het werk, zoals de voorbereidingstijd die een kandidaat krijgt voor een mondeling examen. “xhigh” is de stand net onder het maximum. Elke uitgever hanteert zijn eigen schaal, waardoor hetzelfde woord bij Anthropic niet dezelfde dosis nadenktijd garandeert als bij OpenAI.
Elke AI werkte alleen, in een lege map, met haar oorspronkelijke instellingen en in haar sandbox, een afgesloten ruimte waarin ze in haar eigen map kan schrijven en op het web kan zoeken zonder de rest van de computer aan te raken. Ons artikel over de sandbox van Claude Code en Codex beschrijft in detail wat ze blokkeert. Hier verbood ze het openen van een browser: geen van beide AI’s kon haar scène bekijken voordat ze die opleverde.
Claude Opus 5.5 bouwde een echte vissersboot
Opus 5.5 leverde een vissersboot met twee masten, met baksteenrode, gelooide zeilen zoals die van oude werkboten. De donkere romp heeft een lichte waterlijn. Op het dek staan een kajuit met verlichte patrijspoorten, een reddingsboei, netten, oranje boeien, kisten en opgerolde touwen. De planken van het dek en het zeildoek worden door de code zelf getekend, zonder één enkele van buitenaf geladen afbeelding.
De zee is een diepe deining die zich diep genoeg vormt om de romp soms aan het zicht te onttrekken. Ze glijdt onder de boot door, die daardoor lijkt te varen, met schuim op de golftoppen, tegen de romp en in het kielzog. Er spat zeewater op wanneer de boeg in een golf duikt. Vier lantaarns verlichten het dek, en drie daarvan, die hangen, zwaaien mee met het slingeren van de boot.
Buiten de bliksemflitsen om is de nacht echt pikzwart. Je herkent de boot aan haar lantaarns, aan haar patrijspoorten en aan hun weerspiegeling die op het water glinstert, onder een dichte regen van 16.000 strepen die oranje kleuren vlak bij de lantaarns. Elke bliksem komt in twee tot vier snel opeenvolgende flitsen. Hij verlicht de lucht achter de wolken, tekent hun silhouet af, onthult in één keer de hoogte van de golven, en in één op de vijf gevallen blijft hij verborgen in de wolken.
GPT-6 Sol, een helderdere en rustigere scène
GPT-6 Sol bouwde een zeilboot met één mast, met een lichte romp en een houten dek, met een kleine kajuit met verlichte ramen, vaten, kisten en een rode vlag die in de wind klappert. Drie lantaarns verlichten het dek en tekenen warme lichtvlekken op het water. Twee bleke strepen markeren het kielzog.
De lucht is zwart, maar de zee, in een lichtgevend blauwgroen, weerkaatst veel licht, en de golven blijven klein. De scène is meteen vanaf de eerste seconde duidelijk, met meer de sfeer van een tochtje op zee tijdens een regenachtige avond dan van een storm. De lage wolken bestaan uit grote, hoekige blokken. Wanneer de bliksem toeslaat, verschijnt er een gestreepte boog aan de horizon en kleurt de hele zee in één keer wit.
Beide bestanden voldoen aan de dertien punten van de opdracht, zonder een enkele fout bij het laden. Het verschil zit in de interpretatie: Opus 5.5 nam “zeilende vissersboot” en “storm” letterlijk, GPT-6 Sol leverde een ingetogener scène die aangenamer oogt.
Negenendertig minuten tegen vijf
GPT-6 Sol leverde zijn bestand na 5 minuten op. Opus 5.5 dacht bijna een half uur na voordat het de eerste regel schreef, bouwde zijn pagina daarna stuk voor stuk op, en las en corrigeerde die in ongeveer tien minuten, goed voor 38 minuten en 39 seconden in totaal.
Tegen het publieke API-tarief, dat wat ontwikkelaars betalen die een model in hun eigen programma’s inbouwen, zou de sessie van Opus 5.5 ongeveer 6,96 dollar kosten, en die van GPT-6 Sol ongeveer 0,29 dollar. Beide zijn betaald via een abonnement, Claude aan de ene kant en ChatGPT aan de andere, dat die sessies verrekent in een quotum in plaats van in dollars.
Het verschil zit niet in de weergegeven prijs. Anthropic rekent voor Opus 5.5 tweeënhalf keer minder dan voor Fable 5.1, maar bij deze opdracht produceerde het bijna vijf keer meer tekst dan Fable 5.1 bij het eerste duel, en bijna zestien keer meer dan GPT-6 Sol. Het grootste deel van die tekst is een denkkladje dat niemand leest, maar dat wel wordt doorberekend. Op 7 september deed Fable 5.1 er 20,5 minuten over en GPT-6 Astra 13,5 minuten, voor ongeveer 4,70 en 2,20 dollar. GPT-6 Sol doet dus hetzelfde werk bijna drie keer sneller en bijna acht keer goedkoper dan zijn voorganger, terwijl Opus 5.5 bij deze storm duurder uitviel dan Fable 5.1.
Vloeiend op een recente Mac, trager zonder videokaart
Op een computer zonder videokaart tekent de processor alles, als een schilder alleen voor zijn doek. Onder die omstandigheden toont de scène van GPT-6 Sol 36 frames per seconde, die van Opus 5.5 maar 16 (een bioscoopfilm telt er 24). Een recente videokaart lijkt eerder op een atelier met duizenden kleine handen die tegelijk schilderen, en daar draait de volgorde om: 753 frames per seconde voor Opus 5.5 tegenover 327 voor GPT-6 Sol, gemeten zonder limiet op een Mac met een M5 Pro-chip.
Opus 5.5 laat bijna al het werk over aan de videokaart, tot de regendruppels toe. GPT-6 Sol herberekent de zee en de regen op de processor bij elk beeld. Op een recente computer gaan beide scènes ruim boven de gevraagde 60 frames per seconde, en de test meet de vloeiendheid op jouw eigen machine.
Welke kies je?
- Voor een scène die trouw blijft aan de opdracht en meteen indruk maakt, Claude Opus 5.5, met ongeveer veertig minuten en een paar dollar per poging.
- Om snel en vaak te proberen, GPT-6 Sol: vijf minuten en een paar cent per poging, ook al vraag je er dan nog een donkerdere zee en een echte vissersboot bij. Bij langere projecten, bericht na bericht bijgestuurd, heeft Codex al een op Dune 2000 geïnspireerd spelprototype gebouwd.
- Als je zelf wilt vergelijken, houd er dan rekening mee dat elke poging een deel van de keuzes van de AI aan het toeval overlaat. Morgen opnieuw uitgevoerd, zou dezelfde opdracht twee andere scènes opleveren. De test bewaart daarom de opdracht en de twee bestanden online, die je kunt downloaden en opnieuw afspelen.
Wat je moet onthouden
- Dezelfde opdracht, dezelfde instelling, één enkele poging: Claude Opus 5.5 en GPT-6 Sol voldoen allebei aan de dertien eisen, zonder fout bij het laden.
- Claude Opus 5.5 levert de meest getrouwe storm, met een echte vissersboot, opspattend zeewater en bliksem die de wolken aftekent, in bijna 39 minuten en voor ongeveer 6,96 dollar tegen het API-tarief.
- GPT-6 Sol levert een helderdere en rustigere scène in 5 minuten, voor ongeveer 0,29 dollar.
- Zonder videokaart is de scène van GPT-6 Sol het vloeiendst. Op een recente videokaart is dat die van Opus 5.5.
- Geen van beide AI’s heeft haar scène gezien voordat ze die opleverde, en dit oordeel berust op één enkele poging van elk, op 22 september 2026.


