Claude Opus 5.5 contre GPT-6 Sol : la même tempête en 3D

Anthropic et OpenAI ont sorti le même jour Claude Opus 5.5 et GPT-6 Sol. Je leur ai donné la consigne de notre premier duel, un voilier dans une tempête de nuit en 3D, et les deux scènes s'exécutent ici, avec le temps et le prix de chacune.

Claude Opus 5.5 contre GPT-6 Sol : les deux scènes de tempête en 3D au moment d'un éclair, le bateau de pêche aux voiles rouges et le voilier blanc
Réponse rapide

Sur la même consigne en 3D, un voilier de pêche dans une tempête de nuit, Claude Opus 5.5 dans Claude Code livre la scène la plus fidèle, mais en près de 39 minutes et pour environ 6,96 $ au tarif de l'API. GPT-6 Sol dans Codex remplit aussi les treize points de la consigne en 5 minutes pour environ 0,29 $, avec une scène plus claire et moins orageuse. Les deux scènes s'exécutent dans l'article.

Le 22 septembre 2026, Anthropic a sorti Claude Opus 5.5 et OpenAI a sorti GPT-6 Sol, le même jour. Le soir même, j’ai confié aux deux la consigne de notre premier duel, un voilier de pêche pris dans une tempête de nuit, en 3D, dans une simple page web.

Chaque modèle travaille dans l’assistant de programmation de son éditeur, Claude Code pour Opus 5.5 et Codex pour GPT-6 Sol. Ces assistants ne se contentent pas de répondre dans une fenêtre de discussion. Ils écrivent des fichiers sur l’ordinateur, lancent des commandes et relisent leur travail. Les deux scènes livrées tournent ci-dessous, dans votre navigateur. Cliquez sur « Tout exécuter », ou ouvrez la vue plein écran pour les voir côte à côte.

Vue plein écran

Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.

Prompt commun
code
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).

Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.

Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protocole

La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.

AClaude Code · Claude Opus 5.5Claude Opus 5.5 (xhigh)Retenu

S’exécute dans une sandbox isolée (iframe sandbox et CSP) : aucun accès au site, aux cookies ni à votre session. Rien ne se charge avant votre clic.

TéléchargerOuvrir à part
Éditeur
Anthropic
Modèle
Claude Opus 5.5 (xhigh)
Outil
Claude Code
Date
2026-09-22
Durée
38 min 39 s
Coût
≈ 6,96 $ au tarif de l'API (payé par l'abonnement Claude)
Taille du fichier
42 Ko
BCodex · GPT-6 SolGPT-6 Sol (xhigh)

S’exécute dans une sandbox isolée (iframe sandbox et CSP) : aucun accès au site, aux cookies ni à votre session. Rien ne se charge avant votre clic.

TéléchargerOuvrir à part
Éditeur
OpenAI
Modèle
GPT-6 Sol (xhigh)
Outil
Codex
Date
2026-09-22
Durée
5 min 03 s
Coût
≈ 0,29 $ au tarif de l'API (payé par l'abonnement ChatGPT)
Taille du fichier
20 Ko
MesuresA · Claude Code · Claude Opus 5.5B · Codex · GPT-6 Sol
Temps de travail38 min 39 s5 min 03 s
Coût au tarif public de l'API≈ 6,96 $≈ 0,29 $
Points de la consigne respectés13 sur 1313 sur 13
Erreurs au chargement00
Poids de la page42 Ko20 Ko
Bateaubateau de pêche à deux mâts, voiles tannéesvoilier de plaisance à un mât
Lanternes4, dont 3 qui se balancent3
Images par seconde sans carte graphique (rendu logiciel, sans limite)1636
Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite)753327

Verdict

Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.

Deux modèles sortis le même jour

Anthropic présente Claude Opus 5.5 comme un modèle du niveau de Claude Fable 5.1 sur la plupart des tâches, 40 % moins cher à faire tourner qu’Opus 5. Son annonce du 22 septembre cite même un testeur qui a fait construire un jeu à plusieurs modèles Claude à partir d’une seule consigne : Opus 5.5 a eu la meilleure note pour ses graphismes et sa finition.

Chez OpenAI, GPT-6 Sol reprend les avancées de GPT-6 Astra dans un modèle plus rapide et moins cher. L’annonce publiée le 22 septembre sur le forum des développeurs d’OpenAI le rend disponible dans Codex pour les abonnements Plus, Pro, Business, Enterprise et Edu, avec des prix d’API divisés par deux par rapport aux tarifs promotionnels de GPT-5.6. 9to5Mac le décrit comme le modèle des tâches de programmation complexes, face à GPT-6 Luna, pensé pour des tâches plus ciblées et répétées en grand volume.

La consigne, mot pour mot celle du premier duel

La demande tient en une page. Elle réclame une scène en three.js, une bibliothèque gratuite qui sert à dessiner de la 3D dans une page web, livrée dans un seul fichier que l’on ouvre dans n’importe quel navigateur. Le sujet : un voilier de pêche qui navigue de nuit sur une mer agitée, en pleine tempête.

Treize exigences suivent. Une mer qui bouge, de l’écume sur les crêtes, une nuit noire, des nuages bas, une pluie poussée par le vent et des éclairs à intervalle irrégulier. Un bateau construit uniquement avec des formes de base (cubes, cylindres, sphères), qui tangue et roule avec les vagues, et au moins trois lanternes à la lumière vacillante. Enfin, une caméra que l’on fait tourner à la souris, une fenêtre qu’on peut redimensionner, un petit texte d’aide et un seul fichier. La consigne complète se lit dans le banc, sous « Prompt commun ».

Même réglage, même sandbox, un seul essai

Le 7 septembre, notre premier comparatif de Claude Code et Codex opposait Claude Fable 5.1 et GPT-6 Astra sur exactement la même consigne. J’en ai repris les règles : un seul essai, aucune retouche, et le même niveau de réflexion des deux côtés, « xhigh ».

Ce réglage fixe le temps que l’IA peut passer à réfléchir avant et pendant son travail, comme le temps de préparation laissé à un candidat avant un oral. « xhigh » est le cran juste sous le maximum. Chaque éditeur gradue sa propre échelle, si bien que le même mot ne garantit pas la même dose de réflexion chez Anthropic et chez OpenAI.

Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d’origine et dans sa sandbox, une pièce fermée où elle peut écrire dans son dossier et chercher sur le web sans toucher au reste de l’ordinateur. Notre article sur la sandbox de Claude Code et de Codex détaille ce qu’elle bloque. Ici, elle interdisait d’ouvrir un navigateur : aucune des deux IA n’a pu regarder sa scène avant de la rendre.

Claude Opus 5.5 a construit un vrai bateau de pêche

Opus 5.5 a livré un bateau de pêche à deux mâts, aux voiles tannées couleur brique comme celles des anciens bateaux de travail. La coque sombre porte une ligne de flottaison claire. Sur le pont, on trouve une cabine aux hublots éclairés, une bouée couronne, des filets, des bouées orange, des caisses et des cordages enroulés. Les planches du pont et la toile des voiles sont peintes par le code lui-même, sans aucune image chargée de l’extérieur.

La mer est une houle profonde qui se creuse assez pour cacher parfois la coque. Elle défile sous le bateau, qui semble avancer, avec de l’écume sur les crêtes, contre la coque et dans le sillage. Des embruns jaillissent quand l’avant plonge dans une vague. Quatre lanternes éclairent le pont, et trois d’entre elles, suspendues, se balancent au rythme du roulis.

Hors des éclairs, la nuit est vraiment noire. On devine le bateau à ses lanternes, à ses hublots et à leurs reflets qui scintillent sur l’eau, sous une pluie serrée de 16 000 traits qui se teintent d’orange près des lanternes. Chaque éclair arrive en deux à quatre flashs rapprochés. Il allume le ciel derrière les nuages, découpe leur silhouette, révèle d’un coup la hauteur des vagues, et une fois sur cinq il reste caché dans les nuages.

GPT-6 Sol, une scène plus claire et plus calme

GPT-6 Sol a construit un voilier à un seul mât, coque claire et pont en bois, avec une petite cabine aux fenêtres éclairées, des tonneaux, des caisses et un drapeau rouge qui claque au vent. Trois lanternes éclairent le pont et dessinent sur l’eau des taches de lumière chaude. Deux traînées pâles marquent son sillage.

Le ciel est noir, mais la mer, d’un bleu-vert lumineux, renvoie beaucoup de lumière, et les vagues restent petites. La scène se lit bien dès la première seconde, avec un air de sortie en mer un soir de pluie plus que de tempête. Les nuages bas sont faits de gros blocs à facettes. Quand l’éclair frappe, un arc zébré apparaît à l’horizon et toute la mer blanchit d’un coup.

Les deux fichiers cochent les treize points de la consigne, sans une seule erreur au chargement. La différence tient à l’interprétation : Opus 5.5 a pris « voilier de pêche » et « tempête » au pied de la lettre, GPT-6 Sol a livré une scène plus sage et plus facile à regarder.

Trente-neuf minutes contre cinq

GPT-6 Sol a rendu son fichier au bout de 5 minutes. Opus 5.5 a réfléchi près d’une demi-heure avant d’écrire la première ligne, puis il a construit sa page morceau par morceau et l’a relue et corrigée en une dizaine de minutes, pour 38 minutes et 39 secondes en tout.

Au tarif public de l’API, celui que paient les développeurs qui branchent un modèle dans leurs propres programmes, le passage d’Opus 5.5 vaudrait environ 6,96 dollars, et celui de GPT-6 Sol environ 0,29 dollar. Les deux ont été payés par un abonnement, Claude d’un côté et ChatGPT de l’autre, qui décompte ces passages dans un quota plutôt qu’en dollars.

L’écart ne vient pas du prix affiché. Anthropic facture Opus 5.5 deux fois et demie moins cher que Fable 5.1, mais sur cette consigne il a produit près de cinq fois plus de texte que Fable 5.1 au premier duel, et près de seize fois plus que GPT-6 Sol. L’essentiel de ce texte est un brouillon de réflexion que personne ne lit, mais qui se paie. Le 7 septembre, Fable 5.1 avait mis 20 minutes et demie et GPT-6 Astra 13 minutes et demie, pour environ 4,70 et 2,20 dollars. GPT-6 Sol fait donc le même travail près de trois fois plus vite et près de huit fois moins cher que son aîné, alors qu’Opus 5.5 a coûté plus cher que Fable 5.1 sur cette tempête.

Fluide sur un Mac récent, plus lent sans carte graphique

Sur un ordinateur sans carte graphique, le processeur dessine tout, comme un peintre seul devant sa toile. Dans ces conditions, la scène de GPT-6 Sol affiche 36 images par seconde, celle d’Opus 5.5 seulement 16 (un film de cinéma en compte 24). Une carte graphique récente ressemble plutôt à un atelier de milliers de petites mains qui peignent en même temps, et là l’ordre s’inverse : 753 images par seconde pour Opus 5.5 contre 327 pour GPT-6 Sol, mesurées sans limite sur un Mac équipé d’une puce M5 Pro.

Opus 5.5 confie presque tout le travail à la carte graphique, jusqu’aux gouttes de pluie. GPT-6 Sol recalcule la mer et la pluie sur le processeur à chaque image. Sur un ordinateur récent, les deux scènes dépassent largement les 60 images par seconde demandées, et le banc mesure la fluidité sur votre propre machine.

Lequel choisir ?

  • Pour une scène qui colle à la consigne et fait de l’effet du premier coup, Claude Opus 5.5, en prévoyant une quarantaine de minutes et quelques dollars par essai.
  • Pour essayer vite et souvent, GPT-6 Sol : cinq minutes et quelques centimes par essai, quitte à lui demander ensuite une mer plus sombre et un vrai bateau de pêche. Sur des projets plus longs, guidé message après message, Codex a déjà construit un prototype de jeu inspiré de Dune 2000.
  • Pour comparer à votre tour, gardez en tête que chaque essai tire au sort une partie des choix de l’IA. Relancée demain, la même consigne donnerait deux autres scènes. Le banc garde donc en ligne la consigne et les deux fichiers, que vous pouvez télécharger et rejouer.

Ce qu’il faut retenir

  • Même consigne, même réglage, un seul essai : Claude Opus 5.5 et GPT-6 Sol cochent chacun les treize exigences, sans erreur au chargement.
  • Claude Opus 5.5 livre la tempête la plus fidèle, avec un vrai bateau de pêche, des embruns et des éclairs qui découpent les nuages, en près de 39 minutes et pour environ 6,96 dollars au tarif de l’API.
  • GPT-6 Sol rend une scène plus claire et plus calme en 5 minutes, pour environ 0,29 dollar.
  • Sans carte graphique, la scène de GPT-6 Sol est la plus fluide. Sur une carte graphique récente, c’est celle d’Opus 5.5.
  • Aucune des deux IA n’a vu sa scène avant de la rendre, et ce verdict tient à un seul essai de chacune, le 22 septembre 2026.

BenchmarkClaude CodeClaude Opus 5.5CodexGPT-6 Solthree.js

Damien Flandrin Développeur web depuis 2010, créateur de Gekkode et d’Email Impact. Chaque article est testé sur un projet réel avant publication. Contact
Newsletter

Les nouveaux tests, tutoriels et projets, par e-mail.

Tests reproductibles, code versionné, résultats datés. Jamais de spam.