
Com o mesmo prompt em 3D, um barco de pesca numa tempestade noturna, o Claude Opus 5.5 no Claude Code entrega a cena mais fiel, mas em quase 39 minutos e por cerca de 6,96 $ à tarifa da API. O GPT-6 Sol no Codex também cumpre os treze pontos do prompt em 5 minutos por cerca de 0,29 $, com uma cena mais clara e menos tempestuosa. As duas cenas executam-se no artigo.
A 22 de setembro de 2026, a Anthropic lançou o Claude Opus 5.5 e a OpenAI lançou o GPT-6 Sol, no mesmo dia. Nessa mesma noite, confiei aos dois o prompt do nosso primeiro duelo, um barco de pesca apanhado numa tempestade noturna, em 3D, numa simples página web.
Cada modelo trabalha no assistente de programação do seu criador, o Claude Code para o Opus 5.5 e o Codex para o GPT-6 Sol. Estes assistentes não se limitam a responder numa janela de conversa. Escrevem ficheiros no computador, executam comandos e releem o seu próprio trabalho. As duas cenas entregues correm abaixo, no teu navegador. Clica em «Executar tudo», ou abre a vista em ecrã inteiro para as veres lado a lado.
Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.
Prompt comum
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).
Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.
Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protocolo
La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.
Corre numa sandbox isolada (iframe sandbox e CSP): sem acesso ao site, aos cookies nem à sua sessão. Nada é carregado antes do seu clique.
Corre numa sandbox isolada (iframe sandbox e CSP): sem acesso ao site, aos cookies nem à sua sessão. Nada é carregado antes do seu clique.
| Medições | A · Claude Code · Claude Opus 5.5 | B · Codex · GPT-6 Sol |
|---|---|---|
| Temps de travail | 38 min 39 s | 5 min 03 s |
| Coût au tarif public de l'API | ≈ 6,96 $ | ≈ 0,29 $ |
| Points de la consigne respectés | 13 sur 13 | 13 sur 13 |
| Erreurs au chargement | 0 | 0 |
| Poids de la page | 42 Ko | 20 Ko |
| Bateau | bateau de pêche à deux mâts, voiles tannées | voilier de plaisance à un mât |
| Lanternes | 4, dont 3 qui se balancent | 3 |
| Images par seconde sans carte graphique (rendu logiciel, sans limite) | 16 | 36 |
| Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite) | 753 | 327 |
Veredicto
Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.
Dois modelos lançados no mesmo dia
A Anthropic apresenta o Claude Opus 5.5 como um modelo ao nível do Claude Fable 5.1 na maioria das tarefas, 40% mais barato de executar do que o Opus 5. O seu anúncio de 22 de setembro cita mesmo um testador que fez vários modelos Claude construírem um jogo a partir de um único prompt: o Opus 5.5 teve a melhor nota pelos seus gráficos e pelo acabamento.
Do lado da OpenAI, o GPT-6 Sol retoma os avanços do GPT-6 Astra num modelo mais rápido e mais barato. O anúncio publicado a 22 de setembro no fórum de programadores da OpenAI torna-o disponível no Codex para as subscrições Plus, Pro, Business, Enterprise e Edu, com preços de API reduzidos a metade em relação às tarifas promocionais do GPT-5.6. O 9to5Mac descreve-o como o modelo das tarefas de programação complexas, face ao GPT-6 Luna, pensado para tarefas mais específicas e repetidas em grande volume.
O prompt, palavra por palavra o do primeiro duelo
O pedido cabe numa página. Pede uma cena em three.js, uma biblioteca gratuita que serve para desenhar 3D numa página web, entregue num único ficheiro que se abre em qualquer navegador. O tema: um barco de pesca que navega de noite num mar agitado, em plena tempestade.
Seguem-se treze exigências. Um mar que se mexe, espuma nas cristas, uma noite negra, nuvens baixas, uma chuva empurrada pelo vento e relâmpagos a intervalos irregulares. Um barco construído apenas com formas básicas (cubos, cilindros, esferas), que oscila e balança com as ondas, e pelo menos três lanternas de luz trémula. Por fim, uma câmara que se roda com o rato, uma janela redimensionável, um pequeno texto de ajuda e um único ficheiro. O prompt completo lê-se no banco, em «Prompt comum».
Mesma configuração, mesma sandbox, uma só tentativa
A 7 de setembro, o nosso primeiro comparativo entre o Claude Code e o Codex opôs o Claude Fable 5.1 ao GPT-6 Astra, exatamente com o mesmo prompt. Retomei as suas regras: uma só tentativa, nenhum retoque, e o mesmo nível de reflexão dos dois lados, «xhigh».
Esta configuração fixa o tempo que a IA pode passar a refletir antes e durante o seu trabalho, como o tempo de preparação dado a um candidato antes de um oral. «xhigh» é o patamar mesmo abaixo do máximo. Cada criador gradua a sua própria escala, pelo que a mesma palavra não garante a mesma dose de reflexão na Anthropic e na OpenAI.
Cada IA trabalhou sozinha, numa pasta vazia, com as suas configurações de origem e dentro da sua sandbox, uma sala fechada onde pode escrever na sua pasta e pesquisar na web sem tocar no resto do computador. O nosso artigo sobre a sandbox do Claude Code e do Codex detalha o que ela bloqueia. Aqui, impedia abrir um navegador: nenhuma das duas IA conseguiu ver a sua cena antes de a entregar.
O Claude Opus 5.5 construiu um verdadeiro barco de pesca
O Opus 5.5 entregou um barco de pesca de dois mastros, com velas curtidas cor de tijolo como as dos antigos barcos de trabalho. O casco escuro tem uma linha de flutuação clara. No convés encontram-se uma cabine com vigias iluminadas, uma boia salva-vidas, redes, boias laranja, caixas e cordas enroladas. As tábuas do convés e a lona das velas são pintadas pelo próprio código, sem nenhuma imagem carregada do exterior.
O mar é uma ondulação profunda que se abre o suficiente para esconder por vezes o casco. Desliza sob o barco, que parece avançar, com espuma nas cristas, contra o casco e na esteira. Borrifos saltam quando a proa mergulha numa onda. Quatro lanternas iluminam o convés, e três delas, suspensas, oscilam ao ritmo do balanço.
Fora dos relâmpagos, a noite é mesmo negra. Adivinha-se o barco pelas suas lanternas, pelas suas vigias e pelos seus reflexos a cintilar na água, sob uma chuva cerrada de 16 000 traços que se tingem de laranja perto das lanternas. Cada relâmpago chega em dois a quatro clarões seguidos. Acende o céu atrás das nuvens, recorta a sua silhueta, revela de repente a altura das ondas, e uma vez em cada cinco fica escondido nas nuvens.
O GPT-6 Sol, uma cena mais clara e mais calma
O GPT-6 Sol construiu um veleiro de um só mastro, casco claro e convés de madeira, com uma pequena cabine de janelas iluminadas, barris, caixas e uma bandeira vermelha a esvoaçar ao vento. Três lanternas iluminam o convés e desenham na água manchas de luz quente. Dois rastos pálidos marcam a sua esteira.
O céu é negro, mas o mar, de um azul-esverdeado luminoso, reflete muita luz, e as ondas mantêm-se pequenas. A cena lê-se bem desde o primeiro segundo, com um ar mais de saída ao mar numa noite de chuva do que de tempestade. As nuvens baixas são feitas de grandes blocos facetados. Quando o relâmpago cai, um arco em ziguezague aparece no horizonte e todo o mar embranquece de repente.
Os dois ficheiros cumprem os treze pontos do prompt, sem um único erro no carregamento. A diferença está na interpretação: o Opus 5.5 levou «barco de pesca» e «tempestade» à letra, o GPT-6 Sol entregou uma cena mais comportada e mais fácil de olhar.
Trinta e nove minutos contra cinco
O GPT-6 Sol entregou o seu ficheiro ao fim de 5 minutos. O Opus 5.5 refletiu quase meia hora antes de escrever a primeira linha, depois construiu a sua página pedaço a pedaço e reviu-a e corrigiu-a em cerca de dez minutos, para 38 minutos e 39 segundos no total.
À tarifa pública da API, a que pagam os programadores que ligam um modelo aos seus próprios programas, a passagem do Opus 5.5 custaria cerca de 6,96 $, e a do GPT-6 Sol cerca de 0,29 $. As duas foram pagas por uma subscrição, Claude de um lado e ChatGPT do outro, que desconta estas passagens de uma quota e não em dólares.
A diferença não vem do preço anunciado. A Anthropic cobra o Opus 5.5 duas vezes e meia mais barato do que o Fable 5.1, mas neste prompt produziu quase cinco vezes mais texto do que o Fable 5.1 no primeiro duelo, e quase dezasseis vezes mais do que o GPT-6 Sol. A maior parte desse texto é um rascunho de reflexão que ninguém lê, mas que se paga. A 7 de setembro, o Fable 5.1 tinha levado 20 minutos e meio e o GPT-6 Astra 13 minutos e meio, por cerca de 4,70 e 2,20 $. O GPT-6 Sol faz portanto o mesmo trabalho quase três vezes mais depressa e quase oito vezes mais barato do que o seu antecessor, enquanto o Opus 5.5 custou mais caro do que o Fable 5.1 nesta tempestade.
Fluido num Mac recente, mais lento sem placa gráfica
Num computador sem placa gráfica, o processador desenha tudo, como um pintor sozinho diante da sua tela. Nestas condições, a cena do GPT-6 Sol mostra 36 imagens por segundo, a do Opus 5.5 apenas 16 (um filme de cinema conta 24). Uma placa gráfica recente parece-se antes com um atelier de milhares de pequenas mãos a pintar ao mesmo tempo, e aí a ordem inverte-se: 753 imagens por segundo para o Opus 5.5 contra 327 para o GPT-6 Sol, medidas sem limite num Mac equipado com um chip M5 Pro.
O Opus 5.5 confia quase todo o trabalho à placa gráfica, até às gotas de chuva. O GPT-6 Sol recalcula o mar e a chuva no processador a cada imagem. Num computador recente, as duas cenas ultrapassam largamente as 60 imagens por segundo pedidas, e o banco mede a fluidez na tua própria máquina.
Qual escolher?
- Para uma cena fiel ao prompt e que impressiona à primeira, o Claude Opus 5.5, prevendo cerca de quarenta minutos e alguns dólares por tentativa.
- Para experimentar depressa e muitas vezes, o GPT-6 Sol: cinco minutos e uns cêntimos por tentativa, ainda que seja preciso depois pedir-lhe um mar mais escuro e um verdadeiro barco de pesca. Em projetos mais longos, guiado mensagem após mensagem, o Codex já construiu um protótipo de jogo inspirado em Dune 2000.
- Para comparares por tua conta, tem em mente que cada tentativa sorteia uma parte das escolhas da IA. Relançado amanhã, o mesmo prompt daria duas outras cenas. O banco mantém por isso em linha o prompt e os dois ficheiros, que podes descarregar e rejogar.
A reter
- Mesmo prompt, mesma configuração, uma só tentativa: o Claude Opus 5.5 e o GPT-6 Sol cumprem cada um as treze exigências, sem erro no carregamento.
- O Claude Opus 5.5 entrega a tempestade mais fiel, com um verdadeiro barco de pesca, borrifos e relâmpagos que recortam as nuvens, em quase 39 minutos e por cerca de 6,96 $ à tarifa da API.
- O GPT-6 Sol entrega uma cena mais clara e mais calma em 5 minutos, por cerca de 0,29 $.
- Sem placa gráfica, a cena do GPT-6 Sol é a mais fluida. Numa placa gráfica recente, é a do Opus 5.5.
- Nenhuma das duas IA viu a sua cena antes de a entregar, e este veredito assenta numa única tentativa de cada uma, a 22 de setembro de 2026.


