
Con la misma consigna en 3D, un velero de pesca en una tormenta nocturna, Claude Opus 5.5 en Claude Code entrega la escena más fiel, pero en casi 39 minutos y por unos 6,96 $ al precio de la API. GPT-6 Sol en Codex también cumple los trece puntos de la consigna en 5 minutos por unos 0,29 $, con una escena más clara y menos tormentosa. Las dos escenas se ejecutan en el artículo.
El 22 de septiembre de 2026, Anthropic lanzó Claude Opus 5.5 y OpenAI lanzó GPT-6 Sol, el mismo día. Esa misma noche, les encargué a ambos la consigna de nuestro primer duelo, un velero de pesca atrapado en una tormenta nocturna, en 3D, en una simple página web.
Cada modelo trabaja en el asistente de programación de su editor, Claude Code para Opus 5.5 y Codex para GPT-6 Sol. Estos asistentes no se limitan a responder en una ventana de chat. Escriben archivos en el ordenador, ejecutan comandos y revisan su propio trabajo. Las dos escenas entregadas se ejecutan más abajo, en tu navegador. Haz clic en «Ejecutar todo», o abre la vista a pantalla completa para verlas una junto a otra.
Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.
Prompt común
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).
Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.
Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protocolo
La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.
Se ejecuta en un sandbox aislado (iframe sandbox y CSP): sin acceso al sitio, a las cookies ni a tu sesión. Nada se carga antes de tu clic.
Se ejecuta en un sandbox aislado (iframe sandbox y CSP): sin acceso al sitio, a las cookies ni a tu sesión. Nada se carga antes de tu clic.
| Mediciones | A · Claude Code · Claude Opus 5.5 | B · Codex · GPT-6 Sol |
|---|---|---|
| Temps de travail | 38 min 39 s | 5 min 03 s |
| Coût au tarif public de l'API | ≈ 6,96 $ | ≈ 0,29 $ |
| Points de la consigne respectés | 13 sur 13 | 13 sur 13 |
| Erreurs au chargement | 0 | 0 |
| Poids de la page | 42 Ko | 20 Ko |
| Bateau | bateau de pêche à deux mâts, voiles tannées | voilier de plaisance à un mât |
| Lanternes | 4, dont 3 qui se balancent | 3 |
| Images par seconde sans carte graphique (rendu logiciel, sans limite) | 16 | 36 |
| Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite) | 753 | 327 |
Veredicto
Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.
Dos modelos lanzados el mismo día
Anthropic presenta Claude Opus 5.5 como un modelo al nivel de Claude Fable 5.1 en la mayoría de las tareas, un 40 % más barato de ejecutar que Opus 5. Su anuncio del 22 de septiembre cita incluso a un probador que hizo construir un juego a varios modelos Claude a partir de una sola consigna: Opus 5.5 obtuvo la mejor nota por sus gráficos y su acabado.
En OpenAI, GPT-6 Sol recoge los avances de GPT-6 Astra en un modelo más rápido y más barato. El anuncio publicado el 22 de septiembre en el foro de desarrolladores de OpenAI lo pone disponible en Codex para las suscripciones Plus, Pro, Business, Enterprise y Edu, con precios de API reducidos a la mitad respecto a las tarifas promocionales de GPT-5.6. 9to5Mac lo describe como el modelo para tareas de programación complejas, frente a GPT-6 Luna, pensado para tareas más concretas y repetidas en gran volumen.
La consigna, palabra por palabra, la del primer duelo
La petición cabe en una página. Pide una escena en three.js, una biblioteca gratuita que sirve para dibujar 3D en una página web, entregada en un único archivo que se abre en cualquier navegador. El tema: un velero de pesca que navega de noche por un mar agitado, en plena tormenta.
Le siguen trece requisitos. Un mar que se mueve, espuma en las crestas, una noche negra, nubes bajas, una lluvia empujada por el viento y relámpagos a intervalos irregulares. Un barco construido solo con formas básicas (cubos, cilindros, esferas), que cabecea y se balancea con las olas, y al menos tres faroles de luz vacilante. Por último, una cámara que se puede girar con el ratón, una ventana redimensionable, un pequeño texto de ayuda y un solo archivo. La consigna completa se lee en el banco, bajo «Prompt común».
Mismo ajuste, mismo sandbox, un solo intento
El 7 de septiembre, nuestra primera comparativa de Claude Code y Codex enfrentó a Claude Fable 5.1 y GPT-6 Astra con exactamente la misma consigna. Retomé sus reglas: un solo intento, ningún retoque, y el mismo nivel de razonamiento en los dos lados, «xhigh».
Este ajuste fija el tiempo que la IA puede dedicar a pensar antes y durante su trabajo, como el tiempo de preparación que se le da a un candidato antes de un examen oral. «xhigh» es el nivel justo por debajo del máximo. Cada editor gradúa su propia escala, así que la misma palabra no garantiza la misma dosis de razonamiento en Anthropic y en OpenAI.
Cada IA trabajó sola, en una carpeta vacía, con sus ajustes de origen y dentro de su sandbox, una habitación cerrada donde puede escribir en su carpeta y buscar en la web sin tocar el resto del ordenador. Nuestro artículo sobre el sandbox de Claude Code y de Codex detalla lo que bloquea. Aquí, impedía abrir un navegador: ninguna de las dos IA pudo ver su escena antes de entregarla.
Claude Opus 5.5 construyó un barco de pesca de verdad
Opus 5.5 entregó un barco de pesca de dos mástiles, con velas curtidas de color ladrillo como las de los antiguos barcos de trabajo. El casco oscuro lleva una línea de flotación clara. En la cubierta hay una cabina con portillas iluminadas, un salvavidas circular, redes, boyas naranjas, cajas y cabos enrollados. Las tablas de la cubierta y la tela de las velas están pintadas por el propio código, sin ninguna imagen cargada desde fuera.
El mar es un oleaje profundo que se hunde lo bastante como para ocultar a veces el casco. Se desliza bajo el barco, que parece avanzar, con espuma en las crestas, contra el casco y en la estela. Salpicaduras de espuma saltan cuando la proa se hunde en una ola. Cuatro faroles iluminan la cubierta, y tres de ellos, colgantes, oscilan al ritmo del balanceo.
Fuera de los relámpagos, la noche es realmente negra. Se adivina el barco por sus faroles, por sus portillas y por sus reflejos que centellean en el agua, bajo una lluvia densa de 16.000 trazos que se tiñen de naranja cerca de los faroles. Cada relámpago llega en dos a cuatro destellos seguidos. Enciende el cielo detrás de las nubes, recorta su silueta, revela de golpe la altura de las olas, y una de cada cinco veces queda oculto en las nubes.
GPT-6 Sol, una escena más clara y más tranquila
GPT-6 Sol construyó un velero de un solo mástil, casco claro y cubierta de madera, con una pequeña cabina de ventanas iluminadas, toneles, cajas y una bandera roja que ondea al viento. Tres faroles iluminan la cubierta y dibujan en el agua manchas de luz cálida. Dos rastros pálidos marcan su estela.
El cielo es negro, pero el mar, de un azul verdoso luminoso, refleja mucha luz, y las olas se mantienen pequeñas. La escena se lee bien desde el primer segundo, con un aire de salida al mar en una tarde de lluvia más que de tormenta. Las nubes bajas están hechas de grandes bloques facetados. Cuando el relámpago golpea, un arco rayado aparece en el horizonte y todo el mar blanquea de golpe.
Los dos archivos cumplen los trece puntos de la consigna, sin un solo error al cargar. La diferencia está en la interpretación: Opus 5.5 se tomó «velero de pesca» y «tormenta» al pie de la letra, GPT-6 Sol entregó una escena más comedida y más fácil de mirar.
Treinta y nueve minutos contra cinco
GPT-6 Sol entregó su archivo al cabo de 5 minutos. Opus 5.5 estuvo pensando cerca de media hora antes de escribir la primera línea, luego construyó su página trozo a trozo y la releyó y corrigió en una decena de minutos, para 38 minutos y 39 segundos en total.
Al precio público de la API, el que pagan los desarrolladores que conectan un modelo a sus propios programas, el paso de Opus 5.5 costaría unos 6,96 dólares, y el de GPT-6 Sol unos 0,29 dólares. Los dos se pagaron con una suscripción, Claude por un lado y ChatGPT por otro, que descuenta estos pasos de una cuota en lugar de en dólares.
La diferencia no viene del precio anunciado. Anthropic factura Opus 5.5 dos veces y media más barato que Fable 5.1, pero en esta consigna produjo casi cinco veces más texto que Fable 5.1 en el primer duelo, y casi dieciséis veces más que GPT-6 Sol. Lo esencial de ese texto es un borrador de razonamiento que nadie lee, pero que se paga. El 7 de septiembre, Fable 5.1 había tardado 20 minutos y medio y GPT-6 Astra 13 minutos y medio, por unos 4,70 y 2,20 dólares. GPT-6 Sol hace entonces el mismo trabajo casi tres veces más rápido y casi ocho veces más barato que su predecesor, mientras que Opus 5.5 costó más que Fable 5.1 en esta tormenta.
Fluido en un Mac reciente, más lento sin tarjeta gráfica
En un ordenador sin tarjeta gráfica, el procesador lo dibuja todo, como un pintor solo frente a su lienzo. En estas condiciones, la escena de GPT-6 Sol muestra 36 imágenes por segundo, la de Opus 5.5 solo 16 (una película de cine tiene 24). Una tarjeta gráfica reciente se parece más bien a un taller de miles de manos diminutas que pintan a la vez, y ahí el orden se invierte: 753 imágenes por segundo para Opus 5.5 frente a 327 para GPT-6 Sol, medidas sin límite en un Mac equipado con un chip M5 Pro.
Opus 5.5 confía casi todo el trabajo a la tarjeta gráfica, hasta las gotas de lluvia. GPT-6 Sol recalcula el mar y la lluvia en el procesador en cada imagen. En un ordenador reciente, las dos escenas superan ampliamente las 60 imágenes por segundo pedidas, y el banco mide la fluidez en tu propia máquina.
¿Cuál elegir?
- Para una escena que se ciñe a la consigna y causa efecto a la primera, Claude Opus 5.5, previendo unos cuarenta minutos y unos cuantos dólares por intento.
- Para probar rápido y a menudo, GPT-6 Sol: cinco minutos y unos céntimos por intento, aunque luego haya que pedirle un mar más oscuro y un barco de pesca de verdad. En proyectos más largos, guiado mensaje a mensaje, Codex ya ha construido un prototipo de juego inspirado en Dune 2000.
- Para comparar por tu cuenta, ten en cuenta que cada intento sortea una parte de las decisiones de la IA. Repetida mañana, la misma consigna daría otras dos escenas. El banco guarda por tanto en línea la consigna y los dos archivos, que puedes descargar y volver a ejecutar.
Lo que hay que recordar
- Misma consigna, mismo ajuste, un solo intento: Claude Opus 5.5 y GPT-6 Sol cumplen cada uno los trece requisitos, sin errores al cargar.
- Claude Opus 5.5 entrega la tormenta más fiel, con un barco de pesca de verdad, salpicaduras de espuma y relámpagos que recortan las nubes, en casi 39 minutos y por unos 6,96 dólares al precio de la API.
- GPT-6 Sol entrega una escena más clara y más tranquila en 5 minutos, por unos 0,29 dólares.
- Sin tarjeta gráfica, la escena de GPT-6 Sol es la más fluida. En una tarjeta gráfica reciente, lo es la de Opus 5.5.
- Ninguna de las dos IA vio su escena antes de entregarla, y este veredicto se basa en un solo intento de cada una, el 22 de septiembre de 2026.


