
Sullo stesso prompt in 3D, un peschereccio in una tempesta notturna, Claude Opus 5.5 in Claude Code restituisce la scena più fedele, ma in quasi 39 minuti e per circa 6,96 $ al tariffario dell'API. GPT-6 Sol in Codex soddisfa anch'esso i tredici punti del prompt in 5 minuti per circa 0,29 $, con una scena più chiara e meno tempestosa. Le due scene si eseguono nell'articolo.
Il 22 settembre 2026 Anthropic ha lanciato Claude Opus 5.5 e OpenAI ha lanciato GPT-6 Sol, lo stesso giorno. Quella sera stessa ho affidato a entrambi il prompt del nostro primo duello: un peschereccio in una tempesta notturna, in 3D, in una semplice pagina web.
Ogni modello lavora nell’assistente di programmazione del proprio editor, Claude Code per Opus 5.5 e Codex per GPT-6 Sol. Questi assistenti non si limitano a rispondere in una finestra di chat. Scrivono file sul computer, lanciano comandi e rileggono il proprio lavoro. Le due scene consegnate girano qui sotto, nel tuo browser. Clicca su «Esegui tutto», oppure apri la vista a schermo intero per vederle una accanto all’altra.
Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.
Prompt comune
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).
Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.
Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protocollo
La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.
Gira in una sandbox isolata (iframe sandbox e CSP): nessun accesso al sito, ai cookie o alla tua sessione. Nulla viene caricato prima del tuo clic.
Gira in una sandbox isolata (iframe sandbox e CSP): nessun accesso al sito, ai cookie o alla tua sessione. Nulla viene caricato prima del tuo clic.
| Misurazioni | A · Claude Code · Claude Opus 5.5 | B · Codex · GPT-6 Sol |
|---|---|---|
| Temps de travail | 38 min 39 s | 5 min 03 s |
| Coût au tarif public de l'API | ≈ 6,96 $ | ≈ 0,29 $ |
| Points de la consigne respectés | 13 sur 13 | 13 sur 13 |
| Erreurs au chargement | 0 | 0 |
| Poids de la page | 42 Ko | 20 Ko |
| Bateau | bateau de pêche à deux mâts, voiles tannées | voilier de plaisance à un mât |
| Lanternes | 4, dont 3 qui se balancent | 3 |
| Images par seconde sans carte graphique (rendu logiciel, sans limite) | 16 | 36 |
| Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite) | 753 | 327 |
Verdetto
Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.
Due modelli usciti lo stesso giorno
Anthropic presenta Claude Opus 5.5 come un modello al livello di Claude Fable 5.1 sulla maggior parte dei compiti, il 40% più economico da far girare rispetto a Opus 5. Il suo annuncio del 22 settembre cita perfino un tester che ha fatto costruire un gioco a più modelli Claude a partire da un solo prompt: Opus 5.5 ha ottenuto il voto migliore per la grafica e la rifinitura.
In OpenAI, GPT-6 Sol riprende i progressi di GPT-6 Astra in un modello più veloce ed economico. L’annuncio pubblicato il 22 settembre sul forum sviluppatori di OpenAI lo rende disponibile in Codex per gli abbonamenti Plus, Pro, Business, Enterprise ed Edu, con prezzi API dimezzati rispetto alle tariffe promozionali di GPT-5.6. 9to5Mac lo descrive come il modello per i compiti di programmazione complessi, di fronte a GPT-6 Luna, pensato per compiti più mirati e ripetuti in grande volume.
Il prompt, parola per parola quello del primo duello
La richiesta sta in una pagina. Chiede una scena in three.js, una libreria gratuita che serve a disegnare la 3D in una pagina web, consegnata in un solo file da aprire in un browser qualsiasi. Il soggetto: un peschereccio che naviga di notte su un mare agitato, in piena tempesta.
Seguono tredici requisiti. Un mare che si muove, schiuma sulle creste, una notte nera, nuvole basse, una pioggia spinta dal vento e fulmini a intervallo irregolare. Una barca costruita solo con forme di base (cubi, cilindri, sfere), che beccheggia e rolla con le onde, e almeno tre lanterne dalla luce tremolante. Infine, una telecamera che si fa ruotare con il mouse, una finestra ridimensionabile, un breve testo di aiuto e un solo file. Il prompt completo si legge nel banco, sotto «Prompt comune».
Stessa impostazione, stessa sandbox, un solo tentativo
Il 7 settembre, il nostro primo confronto tra Claude Code e Codex opponeva Claude Fable 5.1 e GPT-6 Astra sullo stesso identico prompt. Ne ho ripreso le regole: un solo tentativo, nessun ritocco, e lo stesso livello di ragionamento su entrambi i lati, «xhigh».
Questa impostazione fissa il tempo che l’IA può passare a ragionare prima e durante il suo lavoro, come il tempo di preparazione lasciato a un candidato prima di un orale. «xhigh» è il livello appena sotto il massimo. Ogni editor gradua la propria scala, per cui la stessa parola non garantisce la stessa dose di ragionamento presso Anthropic e presso OpenAI.
Ogni IA ha lavorato da sola, in una cartella vuota, con le sue impostazioni originali e nella propria sandbox, una stanza chiusa dove può scrivere nella propria cartella e cercare sul web senza toccare il resto del computer. Il nostro articolo sulla sandbox di Claude Code e di Codex descrive nel dettaglio ciò che blocca. Qui vietava di aprire un browser: nessuna delle due IA ha potuto guardare la propria scena prima di consegnarla.
Claude Opus 5.5 ha costruito un vero peschereccio
Opus 5.5 ha consegnato un peschereccio a due alberi, con vele trattate color mattone come quelle delle vecchie barche da lavoro. Lo scafo scuro porta una linea di galleggiamento chiara. Sul ponte si trovano una cabina con oblò illuminati, un salvagente anulare, reti, boe arancioni, casse e cime arrotolate. Le assi del ponte e la tela delle vele sono dipinte dal codice stesso, senza alcuna immagine caricata dall’esterno.
Il mare è un’onda lunga e profonda, che si incava abbastanza da nascondere a tratti lo scafo. Scorre sotto la barca, che sembra avanzare, con schiuma sulle creste, contro lo scafo e nella scia. Spruzzi si sollevano quando la prua si tuffa in un’onda. Quattro lanterne illuminano il ponte, e tre di esse, appese, oscillano al ritmo del rollio.
Fuori dai fulmini, la notte è davvero nera. Si intuisce la barca dalle sue lanterne, dai suoi oblò e dai loro riflessi che scintillano sull’acqua, sotto una pioggia fitta di 16.000 strisce che si tingono d’arancione vicino alle lanterne. Ogni fulmine arriva in due o quattro lampi ravvicinati. Accende il cielo dietro le nuvole, ne ritaglia la sagoma, rivela d’un tratto l’altezza delle onde, e una volta su cinque resta nascosto tra le nuvole.
GPT-6 Sol, una scena più chiara e più calma
GPT-6 Sol ha costruito un veliero a un solo albero, scafo chiaro e ponte in legno, con una piccola cabina dalle finestre illuminate, barili, casse e una bandiera rossa che sbatte al vento. Tre lanterne illuminano il ponte e disegnano sull’acqua macchie di luce calda. Due strisce pallide ne segnano la scia.
Il cielo è nero, ma il mare, di un blu-verde luminoso, riflette molta luce, e le onde restano piccole. La scena si legge bene fin dal primo secondo, con un’aria da uscita in mare in una sera di pioggia più che di tempesta. Le nuvole basse sono fatte di grossi blocchi sfaccettati. Quando il fulmine colpisce, un arco zigzagante appare all’orizzonte e tutto il mare sbianca d’un tratto.
I due file spuntano tutti e tredici i punti del prompt, senza un solo errore al caricamento. La differenza sta nell’interpretazione: Opus 5.5 ha preso «peschereccio» e «tempesta» alla lettera, GPT-6 Sol ha consegnato una scena più sobria e più facile da guardare.
Trentanove minuti contro cinque
GPT-6 Sol ha consegnato il suo file dopo 5 minuti. Opus 5.5 ha riflettuto per quasi mezz’ora prima di scrivere la prima riga, poi ha costruito la sua pagina pezzo per pezzo e l’ha riletta e corretta in una decina di minuti, per 38 minuti e 39 secondi in tutto.
Al tariffario pubblico dell’API, quello che pagano gli sviluppatori che collegano un modello ai propri programmi, il passaggio di Opus 5.5 varrebbe circa 6,96 dollari, e quello di GPT-6 Sol circa 0,29 dollari. Entrambi sono stati pagati con un abbonamento, Claude da un lato e ChatGPT dall’altro, che conteggia questi passaggi in una quota anziché in dollari.
Lo scarto non viene dal prezzo esposto. Anthropic fattura Opus 5.5 due volte e mezza meno caro di Fable 5.1, ma su questo prompt ha prodotto quasi cinque volte più testo di Fable 5.1 al primo duello, e quasi sedici volte più di GPT-6 Sol. La maggior parte di questo testo è una bozza di ragionamento che nessuno legge, ma che si paga. Il 7 settembre, Fable 5.1 aveva impiegato 20 minuti e mezzo e GPT-6 Astra 13 minuti e mezzo, per circa 4,70 e 2,20 dollari. GPT-6 Sol fa dunque lo stesso lavoro quasi tre volte più in fretta e quasi otto volte meno caro del suo predecessore, mentre Opus 5.5 è costato più caro di Fable 5.1 su questa tempesta.
Fluido su un Mac recente, più lento senza scheda grafica
Su un computer senza scheda grafica, il processore disegna tutto, come un pittore solo davanti alla sua tela. In queste condizioni, la scena di GPT-6 Sol mostra 36 fotogrammi al secondo, quella di Opus 5.5 solo 16 (un film al cinema ne conta 24). Una scheda grafica recente somiglia piuttosto a un atelier di migliaia di piccole mani che dipingono nello stesso momento, e lì l’ordine si inverte: 753 fotogrammi al secondo per Opus 5.5 contro 327 per GPT-6 Sol, misurati senza limite su un Mac dotato di un chip M5 Pro.
Opus 5.5 affida quasi tutto il lavoro alla scheda grafica, persino le gocce di pioggia. GPT-6 Sol ricalcola il mare e la pioggia sul processore a ogni fotogramma. Su un computer recente, entrambe le scene superano ampiamente i 60 fotogrammi al secondo richiesti, e il banco misura la fluidità sulla tua stessa macchina.
Quale scegliere?
- Per una scena che rispetta il prompt e fa colpo al primo tentativo, Claude Opus 5.5, prevedendo una quarantina di minuti e qualche dollaro a tentativo.
- Per provare in fretta e spesso, GPT-6 Sol: cinque minuti e qualche centesimo a tentativo, salvo poi chiedergli un mare più scuro e un vero peschereccio. Su progetti più lunghi, guidato messaggio dopo messaggio, Codex ha già costruito un prototipo di gioco ispirato a Dune 2000.
- Per confrontare di persona, tieni presente che ogni tentativo sorteggia una parte delle scelte dell’IA. Rilanciato domani, lo stesso prompt darebbe altre due scene. Il banco mantiene quindi online il prompt e i due file, che puoi scaricare e rigiocare.
Cosa ricordare
- Stesso prompt, stessa impostazione, un solo tentativo: Claude Opus 5.5 e GPT-6 Sol soddisfano entrambi i tredici requisiti, senza errori al caricamento.
- Claude Opus 5.5 restituisce la tempesta più fedele, con un vero peschereccio, spruzzi e fulmini che ritagliano le nuvole, in quasi 39 minuti e per circa 6,96 dollari al tariffario dell’API.
- GPT-6 Sol rende una scena più chiara e più calma in 5 minuti, per circa 0,29 dollari.
- Senza scheda grafica, la scena di GPT-6 Sol è la più fluida. Su una scheda grafica recente, è quella di Opus 5.5.
- Nessuna delle due IA ha visto la propria scena prima di consegnarla, e questo verdetto vale per un solo tentativo di ciascuna, il 22 settembre 2026.


