// SPIS TREŚCI
Skąd ten mecz
1 września Anthropic wypuścił Claude Fable 5.1. Trzy dni później OpenAI odpowiedział modelem GPT-6 Astra. Dwie wielkie premiery w jednym tygodniu to prezent dla każdego, kto robi rolki. Po kilku dniach mój feed wyglądał jak zapowiedź walki bokserskiej: „Fable 5.1 vs Astra”, „Astra zmiażdżyła Fable”, „Fable wciąż lepsza w pisaniu”.
Rolkę, od której zaczął się ten wpis, wrzucił japoński twórca Kento Hagino. Dał obu modelom ten sam przepływ pracy: zbudować previz, czyli roboczą scenę 3D w Blenderze, a potem zamienić ją w wideo przez Seedance 2.5 w Higgsfield. Werdykt w opisie jest krótki: Fable 5.1 przegrała z Astrą z kretesem.
Brzmi jak koniec dyskusji. Nie jest. I zaraz wyjaśnię dlaczego.
Dwa modele w jednej tabeli
| Claude Fable 5.1 | GPT-6 Astra | |
|---|---|---|
| Premiera | 1 września 2026 | 4 września 2026 |
| Firma | Anthropic | OpenAI |
| Dostępność | od premiery na wszystkich platformach | stopniowo: najpierw wybrane organizacje, potem plany Plus, Pro, Business i Enterprise; API i AWS |
| Koszt | cennik bazowy bez zmian, ale według Anthropic zwykle ok. 25% taniej w użyciu niż Fable 5 (przy pracy agentowej do 45%) | w ramach abonamentu ChatGPT, dodatkowe użycie na kredyty |
| Czym się chwali | lepsze wyniki niż Fable 5 i GPT-5.6 Sol, mniej fałszywych alarmów w cyberbezpieczeństwie, znakowanie wodne tekstu | obsługa komputera prawie 2× szybsza, programowanie, notatki między długimi sesjami w Codex |
| Co mówią testy twórców | wciąż mocna w ogólnych testach inteligencji | częściej wygrywa w zadaniach wizualnych: gry, sceny 3D, strony |
Uwaga na liczby z internetu. W zestawieniu Chase AI oba modele mają ten sam cennik API (10 USD za milion tokenów wejścia i 50 USD za milion wyjścia), a Astra wygrywa tym, że zużywa mniej tokenów na to samo zadanie. Ten sam tekst przyznaje jednak, że w indeksie Artificial Analysis wyżej jest Fable 5.1 (65,7 do 61,2). Czyli „kto wygrał” zależy od tego, kto liczy i co.
// ARTIFICIAL ANALYSIS INTELLIGENCE INDEX (wg Chase AI)
65,7
61,2
Jeden ranking, jedna liczba. W testach wizualnych twórców częściej wygrywa Astra — dlatego sprawdzam na własnym zadaniu.
Co pokazują testy twórców
Zebrałem to, co przewinęło się przez mój feed w ostatnich dwóch tygodniach:
- Blender + Seedance 2.5. Twórcy (m.in. Kento Hagino i kilka kanałów na YouTube) każą modelowi zbudować scenę w Blenderze przez wtyczkę Higgsfield, a potem wyrenderować z niej wideo. Tu Astra zbiera najlepsze recenzje — sceny są spójniejsze, a kamera robi to, co miała robić.
- Małe gry z jednego promptu. Na chińskim forum linux.do użytkownicy porównywali gry wygenerowane przez oba modele. Opinie o Astrze: dopracowana, grywalna. O Fable: słabsze efekty i więcej błędów.
- Krótkie animacje. Higgsfield sam publikuje pojedynki „Astra vs Fable 5.1” w różnych stylach (papierowe kabuki, japońska opowieść o duchach) — obie wersje renderowane tym samym Seedance 2.5.
Wspólny mianownik? To zadania wizualne i techniczne. Nikt nie robi rolki „kto lepiej napisał opis kategorii w sklepie z kartami pracy”. A to jest moja codzienność.
Dlaczego cudzy test to za mało
Każdy test w internecie ma trzy ukryte zmienne: prompt, liczbę prób i to, co autor pokazał, a czego nie. Rolka trwa 40 sekund. Nie widzisz, ile generacji poszło do kosza. Nie widzisz, czy prompt nie był pisany pod jeden model.
Do tego dochodzi algorytm. „Model X zmiażdżył model Y” zbiera więcej wyświetleń niż „oba są OK, każdy do czego innego”. Nie mówię, że ktoś kłamie. Mówię, że format nagradza wyraźnych zwycięzców.
I ostatnia rzecz: marketing to nie benchmark. Scena 3D może być piękna, a reklama z niej i tak nie sprzeda. Model może mieć najwyższy wynik w matematyce i napisać nagłówek, który nikogo nie zatrzyma.
Jak porównuję modele do pracy marketingowej
Robię to tak samo jak przy testowaniu promptów czatu. Mało, ale uczciwie.
- Wybieram jedno prawdziwe zadanie. Nie „napisz coś kreatywnego”, tylko np. „trzy warianty tekstu reklamy Meta dla pakietu kart pracy na jesień, grupa: nauczycielki przedszkola”.
- Ten sam prompt, te same materiały. Wklejam obu modelom identyczny brief, opis produktu i dwie przykładowe reklamy, które już działały.
- Trzy próby na model. Jedna udana generacja to przypadek. Trzy to już jakiś wzór.
- Oceniam na ślepo. Wyniki wklejam do jednego pliku bez nazw modeli. Oceniam, dopiero potem odkrywam, który jest który.
- Liczę trzy rzeczy: czy trzyma się briefu (0/1), ile poprawek muszę zrobić ręcznie, ile czasu i kredytów to zjadło.
- Zwycięzca idzie na małą kampanię. Ostateczny sędzia to nie ja, tylko CTR i koszt konwersji.
Który model sprawdzić do jakiego zadania
| Zadanie | Na co patrzę | Wskazówka na dziś |
|---|---|---|
| Teksty reklam, nagłówki, maile | ton, trzymanie się briefu, brak waty | testuj oba — tu różnice są najmniejsze, a najbardziej zależą od promptu |
| Previz i scena 3D pod wideo | spójność sceny, praca kamery | w testach twórców prowadzi Astra |
| Proste gry, kalkulatory, interaktywne treści | czy działa od pierwszego razu | testy społeczności wskazują na Astrę; sprawdź na swoim pomyśle |
| Długie teksty SEO i klastry | struktura, fakty, styl marki | test na jednym satelicie, zanim puścisz cały klaster |
| Analiza danych z kampanii | czy liczy poprawnie, czy nie zmyśla | zawsze sprawdzam liczby ręcznie, niezależnie od modelu |
O tym, jak zrobić z previz w Blenderze prawdziwą kreację reklamową, piszę osobno: previz w Blenderze + Seedance 2.5 krok po kroku.
FAQ
Co to jest Claude Fable 5.1?
To model AI firmy Anthropic wydany 1 września 2026 roku. Jest dostępny od premiery na wszystkich platformach Claude, a według producenta w typowym użyciu kosztuje ok. 25% mniej niż Fable 5.
Co to jest GPT-6 Astra?
To model OpenAI ogłoszony 4 września 2026 roku. Trafia do użytkowników stopniowo: najpierw do wybranych organizacji, potem do planów ChatGPT Plus, Pro, Business i Enterprise oraz do API.
Który model jest lepszy: Fable 5.1 czy Astra?
W testach twórców z grami, scenami 3D i wideo częściej wygrywa Astra. W części ogólnych rankingów inteligencji wyżej jest Fable 5.1. Do marketingu warto sprawdzić oba na własnym zadaniu.
Jak porównać modele AI do marketingu?
Weź jedno prawdziwe zadanie, daj obu modelom ten sam prompt, zrób trzy próby na model i oceń wyniki na ślepo. Zwycięzcę sprawdź małą kampanią i patrz na CTR oraz koszt konwersji.
Czy warto zmieniać model po każdej premierze?
Nie. Zmieniaj dopiero wtedy, gdy nowy model wygrywa w Twoim zadaniu kilka razy z rzędu. Premiery co kilka tygodni to norma, a przesiadka zawsze kosztuje czas na nowe prompty.
Źródła
- Anthropic — Introducing Claude Fable 5.1 and Claude Mythos 5.1
- MacRumors — Anthropic Launches Claude Fable 5.1
- OpenAI — GPT-6 Astra
- 9to5Mac — GPT-6 Astra w ChatGPT i Codex
- Chase AI — GPT-6 Astra vs Fable 5.1: What Actually Matters
- Kento Hagino (Instagram) — test Fable 5.1 vs Astra: Blender → Seedance 2.5
— MK · wróć do notatnika





