
Przy tym samym poleceniu w 3D, czyli kutrze rybackim w nocnej burzy, Claude Opus 5.5 w Claude Code tworzy najwierniejszą scenę, ale w niemal 39 minut i za około 6,96 $ według cennika API. GPT-6 Sol w Codex również spełnia wszystkie trzynaście wymagań polecenia w 5 minut za około 0,29 $, ze sceną jaśniejszą i mniej burzliwą. Obie sceny działają bezpośrednio w artykule.
22 września 2026 roku Anthropic wydał Claude Opus 5.5, a OpenAI wydał GPT-6 Sol, tego samego dnia. Tego samego wieczoru dałem obu to samo polecenie z naszego pierwszego pojedynku: kuter rybacki złapany w nocną burzę, w 3D, na zwykłej stronie internetowej.
Każdy model pracuje w asystencie programistycznym swojego wydawcy, Claude Code dla Opus 5.5 i Codex dla GPT-6 Sol. Te asystenty nie ograniczają się do odpowiedzi w oknie czatu. Piszą pliki na komputerze, uruchamiają polecenia i sprawdzają własną pracę. Obie gotowe sceny działają poniżej, w twojej przeglądarce. Kliknij „Uruchom wszystko” albo otwórz widok pełnoekranowy, aby zobaczyć je obok siebie.
Même consigne qu'au premier duel du 7 septembre : un voilier de pêche dans une tempête de nuit, en 3D, dans une seule page web. Un seul passage, aucune retouche, et les deux scènes livrées s'exécutent ici, dans une sandbox, sur votre machine.
Wspólny prompt
Crée une scène 3D en three.js, dans un seul fichier index.html autonome, sans build ni dépendance locale (three.js chargé depuis un CDN par import map en module ES, version r170 ou plus récente).
Sujet : un voilier de pêche navigue de nuit sur une mer agitée, en pleine tempête.
- Mer : surface animée avec des vagues (déplacement de vertex), reflets sombres, écume discrète sur les crêtes si possible.
- Ciel : nuit noire, nuages bas, pluie visible (particules) poussée par le vent.
- Éclairs : toutes les quelques secondes, un éclair illumine brièvement toute la scène (flash, fort contraste, silhouette des nuages), avec un délai aléatoire entre deux éclairs.
- Bateau : coque, pont, mât, gréement et voile, modélisés uniquement avec des primitives three.js (aucun modèle externe, aucune texture externe). Il tangue et roule en suivant les vagues.
- Lanternes : au moins trois lanternes accrochées au bateau, lumière chaude et vacillante, qui éclairent le pont et l'eau autour du bateau.
- Caméra : contrôles orbitaux (OrbitControls) avec une position de départ qui met le bateau en valeur.
- Performance : viser 60 images par seconde sur un ordinateur portable ; le redimensionnement de la fenêtre est géré.
- Interface : aucune, à part un petit texte discret en bas à gauche indiquant les commandes.
Contraintes : tout le code (HTML, CSS, JavaScript) dans index.html ; pas de fichiers supplémentaires ; le fichier doit fonctionner en l'ouvrant directement dans un navigateur moderne (Chrome, Firefox, Safari). Ne pose pas de question, livre le fichier complet.
Protokół
La même consigne, en français, que lors du premier duel du 7 septembre 2026, envoyée telle quelle aux deux IA le 22 septembre 2026, jour de leur sortie, sans échange ensuite ni retouche du résultat. Claude Code avec le modèle Claude Opus 5.5 et Codex avec le modèle GPT-6 Sol, tous deux réglés sur le niveau de réflexion « xhigh », comme au premier duel. Chaque IA a travaillé seule, dans un dossier vide, avec ses réglages d'origine et dans sa sandbox : elle pouvait écrire dans son dossier et chercher sur le web, mais ni sortir de ce dossier ni ouvrir un navigateur. Aucune des deux n'a donc vu sa scène avant de la rendre. Mesures : temps de travail, coût au tarif public de l'API, respect point par point de la consigne, erreurs au chargement, rendu dans Chrome en 1 280 × 720, fluidité sans carte graphique puis sur une carte graphique récente, sans limite d'images par seconde, et fluidité sur votre machine dans ce banc.
Działa w odizolowanym sandboksie (iframe sandbox i CSP): bez dostępu do witryny, ciasteczek ani Twojej sesji. Nic nie ładuje się przed kliknięciem.
Działa w odizolowanym sandboksie (iframe sandbox i CSP): bez dostępu do witryny, ciasteczek ani Twojej sesji. Nic nie ładuje się przed kliknięciem.
| Pomiary | A · Claude Code · Claude Opus 5.5 | B · Codex · GPT-6 Sol |
|---|---|---|
| Temps de travail | 38 min 39 s | 5 min 03 s |
| Coût au tarif public de l'API | ≈ 6,96 $ | ≈ 0,29 $ |
| Points de la consigne respectés | 13 sur 13 | 13 sur 13 |
| Erreurs au chargement | 0 | 0 |
| Poids de la page | 42 Ko | 20 Ko |
| Bateau | bateau de pêche à deux mâts, voiles tannées | voilier de plaisance à un mât |
| Lanternes | 4, dont 3 qui se balancent | 3 |
| Images par seconde sans carte graphique (rendu logiciel, sans limite) | 16 | 36 |
| Images par seconde sur carte graphique récente (Apple M5 Pro, sans limite) | 753 | 327 |
Werdykt
Claude Opus 5.5 livre la tempête la plus fidèle : un bateau de pêche à deux mâts et voiles tannées, une mer noire qui se creuse en houle, des embruns à l'avant, quatre lanternes dont trois se balancent, et des éclairs qui découpent la silhouette des nuages. Il lui a fallu près de 39 minutes et environ 6,96 $ au tarif de l'API. GPT-6 Sol remplit aussi les treize points de la consigne, en 5 minutes et pour environ 0,29 $, avec une scène plus claire et plus calme : un voilier de plaisance, des nuages en facettes et une mer qui blanchit d'un coup sous l'éclair. La meilleure scène d'un côté, près de huit fois plus vite et vingt-quatre fois moins cher de l'autre.
Dwa modele wydane tego samego dnia
Anthropic przedstawia Claude Opus 5.5 jako model na poziomie Claude Fable 5.1 w większości zadań, o 40 % tańszy w użyciu niż Opus 5. W zapowiedzi z 22 września przywołano nawet testera, który kazał kilku modelom Claude zbudować grę na podstawie jednego polecenia: Opus 5.5 dostał najlepszą ocenę za grafikę i wykończenie.
W OpenAI GPT-6 Sol przejmuje postępy z GPT-6 Astra w modelu szybszym i tańszym. Zapowiedź opublikowana 22 września na forum deweloperów OpenAI udostępnia go w Codex dla abonamentów Plus, Pro, Business, Enterprise i Edu, z cenami API obniżonymi o połowę względem promocyjnych stawek GPT-5.6. 9to5Mac opisuje go jako model do złożonych zadań programistycznych, w przeciwieństwie do GPT-6 Luna, pomyślanego do zadań bardziej ukierunkowanych i powtarzanych na dużą skalę.
Polecenie, słowo w słowo to samo co w pierwszym pojedynku
Polecenie mieści się na jednej stronie. Wymaga sceny w three.js, darmowej bibliotece do rysowania grafiki 3D na stronie internetowej, dostarczonej w jednym pliku, który otwiera się w dowolnej przeglądarce. Temat: kuter rybacki płynący nocą po wzburzonym morzu, w samym środku burzy.
Dalej następuje trzynaście wymagań. Poruszające się morze, piana na grzbietach fal, czarna noc, niskie chmury, deszcz gnany wiatrem i błyskawice w nieregularnych odstępach. Łódź zbudowana wyłącznie z podstawowych brył (sześciany, walce, kule), która się przechyla i kołysze na falach, oraz co najmniej trzy latarnie o migoczącym świetle. Wreszcie kamera obracana myszą, okno, które można zmieniać rozmiar, krótki tekst pomocy i jeden jedyny plik. Pełne polecenie znajduje się w zestawieniu, pod „Wspólny prompt”.
Te same ustawienia, ta sama sandbox, jedna próba
7 września nasze pierwsze porównanie Claude Code i Codex zestawiało Claude Fable 5.1 i GPT-6 Astra na dokładnie tym samym poleceniu. Przejąłem te same zasady: jedna próba, żadnych poprawek i ten sam poziom refleksji po obu stronach, „xhigh”.
To ustawienie określa czas, jaki sztuczna inteligencja może poświęcić na zastanowienie przed pracą i w jej trakcie, podobnie jak czas na przygotowanie zostawiony kandydatowi przed egzaminem ustnym. „xhigh” to poziom tuż poniżej maksimum. Każdy wydawca ma własną skalę, więc to samo słowo nie gwarantuje tej samej dawki namysłu u Anthropic i u OpenAI.
Każda sztuczna inteligencja pracowała sama, w pustym folderze, z domyślnymi ustawieniami i we własnej sandbox, zamkniętym pomieszczeniu, w którym może zapisywać pliki w swoim folderze i szukać w sieci, nie dotykając reszty komputera. Nasz artykuł o sandbox Claude Code i Codex opisuje szczegółowo, co ona blokuje. Tutaj zabraniała otwierania przeglądarki: żadna z dwóch sztucznych inteligencji nie mogła zobaczyć swojej sceny przed jej oddaniem.
Claude Opus 5.5 zbudował prawdziwy kuter rybacki
Opus 5.5 dostarczył dwumasztowy kuter rybacki, z ceglastymi, wyprawionymi żaglami jak u dawnych łodzi roboczych. Ciemny kadłub ma jasną linię wodną. Na pokładzie znajduje się kabina z oświetlonymi bulajami, koło ratunkowe, sieci, pomarańczowe boje, skrzynie i zwinięte liny. Deski pokładu i płótno żagli są namalowane przez sam kod, bez żadnego obrazu wczytanego z zewnątrz.
Morze to głęboka fala, która czasem zapada się na tyle, że chowa kadłub. Przesuwa się pod łodzią, sprawiając wrażenie, że ta płynie do przodu, z pianą na grzbietach, przy kadłubie i w kilwaterze. Bryzgi tryskają, gdy dziób zanurza się w fali. Pokład oświetlają cztery latarnie, a trzy z nich, zawieszone, huśtają się w rytm bocznego kołysania.
Poza błyskawicami noc jest naprawdę czarna. Łódź można rozpoznać po latarniach, bulajach i ich odbiciach migoczących na wodzie, pod gęstym deszczem złożonym z 16 000 smug, które przy latarniach barwią się na pomarańczowo. Każda błyskawica pojawia się w postaci od dwóch do czterech szybkich rozbłysków. Rozświetla niebo za chmurami, zarysowuje ich sylwetkę, ujawnia od razu wysokość fal, a co piąty raz pozostaje ukryta w chmurach.
GPT-6 Sol, scena jaśniejsza i spokojniejsza
GPT-6 Sol zbudował jednomasztowy żaglowiec, z jasnym kadłubem i drewnianym pokładem, z małą kabiną o oświetlonych oknach, beczkami, skrzyniami i czerwoną flagą łopoczącą na wietrze. Trzy latarnie oświetlają pokład i rysują na wodzie plamy ciepłego światła. Dwie blade smugi wyznaczają jego kilwater.
Niebo jest czarne, ale morze, w świetlistym kolorze niebiesko-zielonym, odbija dużo światła, a fale pozostają małe. Scena jest czytelna od pierwszej sekundy, bardziej przypomina wieczorny rejs w deszczu niż burzę. Niskie chmury składają się z dużych, wielościennych brył. Gdy uderza błyskawica, na horyzoncie pojawia się postrzępiony łuk, a całe morze od razu bieleje.
Oba pliki spełniają trzynaście punktów polecenia, bez żadnego błędu przy wczytywaniu. Różnica tkwi w interpretacji: Opus 5.5 wziął „kuter rybacki” i „burzę” dosłownie, GPT-6 Sol dostarczył scenę spokojniejszą i łatwiejszą do oglądania.
Trzydzieści dziewięć minut kontra pięć
GPT-6 Sol oddał swój plik po 5 minutach. Opus 5.5 zastanawiał się blisko pół godziny, zanim napisał pierwszą linijkę, potem zbudował swoją stronę kawałek po kawałku i sprawdził ją oraz poprawił w około dziesięciu minut, co dało w sumie 38 minut i 39 sekund.
Według publicznego cennika API, tego, który płacą deweloperzy podłączający model do własnych programów, przebieg Opus 5.5 kosztowałby około 6,96 dolara, a przebieg GPT-6 Sol około 0,29 dolara. Oba zostały opłacone przez abonament, Claude z jednej strony i ChatGPT z drugiej, który rozlicza te przebiegi w ramach limitu, a nie w dolarach.
Różnica nie wynika z podanej ceny. Anthropic wycenia Opus 5.5 dwa i pół raza taniej niż Fable 5.1, ale przy tym poleceniu wygenerował on blisko pięć razy więcej tekstu niż Fable 5.1 w pierwszym pojedynku i blisko szesnaście razy więcej niż GPT-6 Sol. Większość tego tekstu to brudnopis rozumowania, którego nikt nie czyta, ale za który trzeba zapłacić. 7 września Fable 5.1 potrzebował 20 i pół minuty, a GPT-6 Astra 13 i pół minuty, za odpowiednio około 4,70 i 2,20 dolara. GPT-6 Sol wykonuje więc tę samą pracę blisko trzy razy szybciej i blisko osiem razy taniej niż jego poprzednik, podczas gdy Opus 5.5 kosztował więcej niż Fable 5.1 przy tej burzy.
Płynnie na nowym Macu, wolniej bez karty graficznej
Na komputerze bez karty graficznej wszystko rysuje procesor, jak samotny malarz przed swoim płótnem. W tych warunkach scena GPT-6 Sol wyświetla 36 klatek na sekundę, a scena Opus 5.5 tylko 16 (film kinowy ma ich 24). Nowoczesna karta graficzna przypomina raczej pracownię tysięcy małych rąk malujących jednocześnie, i tam kolejność się odwraca: 753 klatki na sekundę dla Opus 5.5 wobec 327 dla GPT-6 Sol, zmierzone bez limitu na Macu z układem M5 Pro.
Opus 5.5 powierza niemal całą pracę karcie graficznej, aż po krople deszczu. GPT-6 Sol przelicza morze i deszcz na procesorze przy każdej klatce. Na nowoczesnym komputerze obie sceny znacznie przekraczają wymagane 60 klatek na sekundę, a zestawienie mierzy płynność na twoim własnym urządzeniu.
Który wybrać?
- Dla sceny wiernej poleceniu i robiącej wrażenie od pierwszego razu, Claude Opus 5.5, licząc na jakieś czterdzieści minut i kilka dolarów za próbę.
- Aby próbować szybko i często, GPT-6 Sol: pięć minut i kilka centów za próbę, choćby po to, by potem poprosić go o ciemniejsze morze i prawdziwy kuter rybacki. Przy dłuższych projektach, prowadzony wiadomość po wiadomości, Codex zbudował już prototyp gry inspirowanej Dune 2000.
- Aby samemu porównać, pamiętaj, że każda próba losuje część wyborów sztucznej inteligencji. Uruchomione ponownie jutro, to samo polecenie dałoby dwie inne sceny. Zestawienie zachowuje więc online polecenie i oba pliki, które możesz pobrać i odtworzyć ponownie.
Co warto zapamiętać
- To samo polecenie, te same ustawienia, jedna próba: Claude Opus 5.5 i GPT-6 Sol spełniają każdy z trzynastu wymagań, bez błędu przy wczytywaniu.
- Claude Opus 5.5 dostarcza najwierniejszą burzę, z prawdziwym kutrem rybackim, bryzgami i błyskawicami rysującymi kontury chmur, w niemal 39 minut i za około 6,96 dolara według cennika API.
- GPT-6 Sol tworzy scenę jaśniejszą i spokojniejszą w 5 minut, za około 0,29 dolara.
- Bez karty graficznej scena GPT-6 Sol jest najbardziej płynna. Na nowoczesnej karcie graficznej to scena Opus 5.5.
- Żadna z dwóch sztucznych inteligencji nie widziała swojej sceny przed jej oddaniem, a ten werdykt opiera się na jednej próbie każdej z nich, 22 września 2026.


