
Sur la même consigne en 3D, un voilier de pêche dans une tempête de nuit, Claude Opus 5.5 dans Claude Code livre la scène la plus fidèle, mais en près de 39 minutes et pour environ 6,96 $ au tarif de l'API. GPT-6 Sol dans Codex remplit aussi les treize points de la consigne en 5 minutes pour environ 0,29 $, avec une scène plus claire et moins orageuse. Les deux scènes s'exécutent dans l'article.
Le 22 septembre 2026, Anthropic a sorti Claude Opus 5.5 et OpenAI a sorti GPT-6 Sol, le même jour. Le soir même, j’ai confié aux deux la consigne de notre premier duel, un voilier de pêche pris dans une tempête de nuit, en 3D, dans une simple page web.
Chaque modèle travaille dans l’assistant de programmation de son éditeur, Claude Code pour Opus 5.5 et Codex pour GPT-6 Sol. Ces assistants ne se contentent pas de répondre dans une fenêtre de discussion. Ils écrivent des fichiers sur l’ordinateur, lancent des commandes et relisent leur travail. Les deux scènes livrées tournent ci-dessous, dans votre navigateur. Cliquez sur « Tout exécuter », ou ouvrez la vue plein écran pour les voir côte à côte.
Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.
Prompt commun
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).
Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.
Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protocole
La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.
S’exécute dans une sandbox isolée (iframe sandbox et CSP) : aucun accès au site, aux cookies ni à votre session. Rien ne se charge avant votre clic.
S’exécute dans une sandbox isolée (iframe sandbox et CSP) : aucun accès au site, aux cookies ni à votre session. Rien ne se charge avant votre clic.
| Mesures | A · Claude Code · Claude Opus 5.5 | B · Codex · GPT-6 Sol |
|---|---|---|
| Temps de travail | 38 min 39 s | 5 min 03 s |
| Coût au tarif public de l'API | ≈ 6,96 $ | ≈ 0,29 $ |
| Points de la consigne respectés | 13 sur 13 | 13 sur 13 |
| Erreurs au chargement | 0 | 0 |
| Poids de la page | 42 Ko | 20 Ko |
| Bateau | bateau de pêche à deux mâts, voiles tannées | voilier de plaisance à un mât |
| Lanternes | 4, dont 3 qui se balancent | 3 |
| Images par seconde sans carte graphique (rendu logiciel, sans limite) | 16 | 36 |
| Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite) | 753 | 327 |
Verdict
Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.
Deux modèles sortis le même jour
Anthropic présente Claude Opus 5.5 comme un modèle du niveau de Claude Fable 5.1 sur la plupart des tâches, 40 % moins cher à faire tourner qu’Opus 5. Son annonce du 22 septembre cite même un testeur qui a fait construire un jeu à plusieurs modèles Claude à partir d’une seule consigne : Opus 5.5 a eu la meilleure note pour ses graphismes et sa finition.
Chez OpenAI, GPT-6 Sol reprend les avancées de GPT-6 Astra dans un modèle plus rapide et moins cher. L’annonce publiée le 22 septembre sur le forum des développeurs d’OpenAI le rend disponible dans Codex pour les abonnements Plus, Pro, Business, Enterprise et Edu, avec des prix d’API divisés par deux par rapport aux tarifs promotionnels de GPT-5.6. 9to5Mac le décrit comme le modèle des tâches de programmation complexes, face à GPT-6 Luna, pensé pour des tâches plus ciblées et répétées en grand volume.
La consigne, mot pour mot celle du premier duel
La demande tient en une page. Elle réclame une scène en three.js, une bibliothèque gratuite qui sert à dessiner de la 3D dans une page web, livrée dans un seul fichier que l’on ouvre dans n’importe quel navigateur. Le sujet : un voilier de pêche qui navigue de nuit sur une mer agitée, en pleine tempête.
Treize exigences suivent. Une mer qui bouge, de l’écume sur les crêtes, une nuit noire, des nuages bas, une pluie poussée par le vent et des éclairs à intervalle irrégulier. Un bateau construit uniquement avec des formes de base (cubes, cylindres, sphères), qui tangue et roule avec les vagues, et au moins trois lanternes à la lumière vacillante. Enfin, une caméra que l’on fait tourner à la souris, une fenêtre qu’on peut redimensionner, un petit texte d’aide et un seul fichier. La consigne complète se lit dans le banc, sous « Prompt commun ».
Même réglage, même sandbox, un seul essai
Le 7 septembre, notre premier comparatif de Claude Code et Codex opposait Claude Fable 5.1 et GPT-6 Astra sur exactement la même consigne. J’en ai repris les règles : un seul essai, aucune retouche, et le même niveau de réflexion des deux côtés, « xhigh ».
Ce réglage fixe le temps que l’IA peut passer à réfléchir avant et pendant son travail, comme le temps de préparation laissé à un candidat avant un oral. « xhigh » est le cran juste sous le maximum. Chaque éditeur gradue sa propre échelle, si bien que le même mot ne garantit pas la même dose de réflexion chez Anthropic et chez OpenAI.
Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d’origine et dans sa sandbox, une pièce fermée où elle peut écrire dans son dossier et chercher sur le web sans toucher au reste de l’ordinateur. Notre article sur la sandbox de Claude Code et de Codex détaille ce qu’elle bloque. Ici, elle interdisait d’ouvrir un navigateur : aucune des deux IA n’a pu regarder sa scène avant de la rendre.
Claude Opus 5.5 a construit un vrai bateau de pêche
Opus 5.5 a livré un bateau de pêche à deux mâts, aux voiles tannées couleur brique comme celles des anciens bateaux de travail. La coque sombre porte une ligne de flottaison claire. Sur le pont, on trouve une cabine aux hublots éclairés, une bouée couronne, des filets, des bouées orange, des caisses et des cordages enroulés. Les planches du pont et la toile des voiles sont peintes par le code lui-même, sans aucune image chargée de l’extérieur.
La mer est une houle profonde qui se creuse assez pour cacher parfois la coque. Elle défile sous le bateau, qui semble avancer, avec de l’écume sur les crêtes, contre la coque et dans le sillage. Des embruns jaillissent quand l’avant plonge dans une vague. Quatre lanternes éclairent le pont, et trois d’entre elles, suspendues, se balancent au rythme du roulis.
Hors des éclairs, la nuit est vraiment noire. On devine le bateau à ses lanternes, à ses hublots et à leurs reflets qui scintillent sur l’eau, sous une pluie serrée de 16 000 traits qui se teintent d’orange près des lanternes. Chaque éclair arrive en deux à quatre flashs rapprochés. Il allume le ciel derrière les nuages, découpe leur silhouette, révèle d’un coup la hauteur des vagues, et une fois sur cinq il reste caché dans les nuages.
GPT-6 Sol, une scène plus claire et plus calme
GPT-6 Sol a construit un voilier à un seul mât, coque claire et pont en bois, avec une petite cabine aux fenêtres éclairées, des tonneaux, des caisses et un drapeau rouge qui claque au vent. Trois lanternes éclairent le pont et dessinent sur l’eau des taches de lumière chaude. Deux traînées pâles marquent son sillage.
Le ciel est noir, mais la mer, d’un bleu-vert lumineux, renvoie beaucoup de lumière, et les vagues restent petites. La scène se lit bien dès la première seconde, avec un air de sortie en mer un soir de pluie plus que de tempête. Les nuages bas sont faits de gros blocs à facettes. Quand l’éclair frappe, un arc zébré apparaît à l’horizon et toute la mer blanchit d’un coup.
Les deux fichiers cochent les treize points de la consigne, sans une seule erreur au chargement. La différence tient à l’interprétation : Opus 5.5 a pris « voilier de pêche » et « tempête » au pied de la lettre, GPT-6 Sol a livré une scène plus sage et plus facile à regarder.
Trente-neuf minutes contre cinq
GPT-6 Sol a rendu son fichier au bout de 5 minutes. Opus 5.5 a réfléchi près d’une demi-heure avant d’écrire la première ligne, puis il a construit sa page morceau par morceau et l’a relue et corrigée en une dizaine de minutes, pour 38 minutes et 39 secondes en tout.
Au tarif public de l’API, celui que paient les développeurs qui branchent un modèle dans leurs propres programmes, le passage d’Opus 5.5 vaudrait environ 6,96 dollars, et celui de GPT-6 Sol environ 0,29 dollar. Les deux ont été payés par un abonnement, Claude d’un côté et ChatGPT de l’autre, qui décompte ces passages dans un quota plutôt qu’en dollars.
L’écart ne vient pas du prix affiché. Anthropic facture Opus 5.5 deux fois et demie moins cher que Fable 5.1, mais sur cette consigne il a produit près de cinq fois plus de texte que Fable 5.1 au premier duel, et près de seize fois plus que GPT-6 Sol. L’essentiel de ce texte est un brouillon de réflexion que personne ne lit, mais qui se paie. Le 7 septembre, Fable 5.1 avait mis 20 minutes et demie et GPT-6 Astra 13 minutes et demie, pour environ 4,70 et 2,20 dollars. GPT-6 Sol fait donc le même travail près de trois fois plus vite et près de huit fois moins cher que son aîné, alors qu’Opus 5.5 a coûté plus cher que Fable 5.1 sur cette tempête.
Fluide sur un Mac récent, plus lent sans carte graphique
Sur un ordinateur sans carte graphique, le processeur dessine tout, comme un peintre seul devant sa toile. Dans ces conditions, la scène de GPT-6 Sol affiche 36 images par seconde, celle d’Opus 5.5 seulement 16 (un film de cinéma en compte 24). Une carte graphique récente ressemble plutôt à un atelier de milliers de petites mains qui peignent en même temps, et là l’ordre s’inverse : 753 images par seconde pour Opus 5.5 contre 327 pour GPT-6 Sol, mesurées sans limite sur un Mac équipé d’une puce M5 Pro.
Opus 5.5 confie presque tout le travail à la carte graphique, jusqu’aux gouttes de pluie. GPT-6 Sol recalcule la mer et la pluie sur le processeur à chaque image. Sur un ordinateur récent, les deux scènes dépassent largement les 60 images par seconde demandées, et le banc mesure la fluidité sur votre propre machine.
Lequel choisir ?
- Pour une scène qui colle à la consigne et fait de l’effet du premier coup, Claude Opus 5.5, en prévoyant une quarantaine de minutes et quelques dollars par essai.
- Pour essayer vite et souvent, GPT-6 Sol : cinq minutes et quelques centimes par essai, quitte à lui demander ensuite une mer plus sombre et un vrai bateau de pêche. Sur des projets plus longs, guidé message après message, Codex a déjà construit un prototype de jeu inspiré de Dune 2000.
- Pour comparer à votre tour, gardez en tête que chaque essai tire au sort une partie des choix de l’IA. Relancée demain, la même consigne donnerait deux autres scènes. Le banc garde donc en ligne la consigne et les deux fichiers, que vous pouvez télécharger et rejouer.
Ce qu’il faut retenir
- Même consigne, même réglage, un seul essai : Claude Opus 5.5 et GPT-6 Sol cochent chacun les treize exigences, sans erreur au chargement.
- Claude Opus 5.5 livre la tempête la plus fidèle, avec un vrai bateau de pêche, des embruns et des éclairs qui découpent les nuages, en près de 39 minutes et pour environ 6,96 dollars au tarif de l’API.
- GPT-6 Sol rend une scène plus claire et plus calme en 5 minutes, pour environ 0,29 dollar.
- Sans carte graphique, la scène de GPT-6 Sol est la plus fluide. Sur une carte graphique récente, c’est celle d’Opus 5.5.
- Aucune des deux IA n’a vu sa scène avant de la rendre, et ce verdict tient à un seul essai de chacune, le 22 septembre 2026.


