GPT-6 Astra vs Claude Fable 5.1: mit tudnak, mennyibe kerülnek, és mit mérnek rajtuk valójában

GPT-6 Astra vs Claude Fable 5.1: számok, tokenek, árak
GPT-6 Astra vs Claude Fable 5.1: mit tudnak, mennyibe kerülnek, és mit mérnek rajtuk valójában Az OpenAI 2026. szeptember 3-án adta ki a GPT-6 Astrát, az Anthropic szeptember 1-jén a Claude Fable 5.1-et. Mindkét modell API-listaára 10 dollár per millió input token és 50 dollár per millió output token, 1 millió token körüli kontextusablakkal és 128 ezer token maximális kimenettel. A gyártói mérésekben az Astra vezet a matematikai, kiberbiztonsági és számítógép-használati teszteken, a Fable 5.1 a Humanity's Last Exam eszközhasználatos változatán és a független Artificial Analysis intelligencia-indexen (66 pont az Astra 61 pontja ellen). A cikk szétszedi, melyik szám kitől származik, mit érdemes elhinni, és mit jelent mindez egy magyar KKV-nak. TimeSaver hu-HU GPT-6 Astra, Claude Fable 5.1, OpenAI, Anthropic, AI modell összehasonlítás, benchmark, API árak, token, kontextusablak, AGI GPT-6 Astra, Claude Fable 5.1, GPT-6 vs Claude, AI modell összehasonlítás magyar, GPT-6 ára, Claude ára, ARC-AGI-3

GPT-6 Astra vs Claude Fable 5.1: mit tudnak, mennyibe kerülnek, és mit mérnek rajtuk valójában

Sinka Gabriella Tímea, 2026. szeptember 4. Olvasási idő: kb. 13 perc.

Röviden, ha nincs 13 perced

48 óra különbséggel jött ki a két csúcsmodell: az Anthropic Claude Fable 5.1 szeptember 1-jén, az OpenAI GPT-6 Astra szeptember 3-án. Az API-listaáruk fillérre ugyanaz: 10 dollár per millió input token, 50 dollár per millió output token, nagyjából 1 millió tokenes kontextussal.

A gyártói táblázatokban az Astra visz szinte mindent: matek, kiberbiztonság, számítógép-használat. A Fable 5.1 viszont veri az Astrát a Humanity's Last Exam eszközhasználatos tesztjén, és az első független mérésen, az Artificial Analysis indexén is előrébb áll (66 pont a 61 ellen). Vagyis nincs "nyertes", munkatípusonként van jobb választás.

És a Brockman-féle "üdvözlünk az AGI korszakában" mondat pontosan az, aminek hangzik: egy elnök véleménye a saját terméke bemutatóján. A számokat ettől függetlenül érdemes megnézni, mert azok tényleg érdekesek.

Mielőtt belemegyünk: a saját rendszereim, az automatizálásaim és az ügyfélmunkáim jelentős része Claude API-ra épül. Ezt tudd, amikor a véleményemet olvasod. A számokat viszont pont ezért forrással együtt adom, hogy ne nekem kelljen hinned.

01Mi jelent meg, mikor, és milyen háttérrel

Szeptember 1-jén az Anthropic kiadta a Claude Fable 5.1-et (és mellé a korlátozott hozzáférésű Claude Mythos 5.1-et). Szeptember 3-án az OpenAI bemutatta a GPT-6 Astrát. Két csúcsmodell, 48 óra különbséggel, és egyik cég sem mérte magát a másik friss modelljéhez, mert egyszerűen nem volt rá idejük. Ezt érdemes észben tartani minden "X veri Y-t" cím olvasásakor.

A háttér sem mellékes. Az OpenAI augusztusban kénytelen volt szüneteltetni bizonyos kutatási és tanítási folyamatokat, miután két modellje egy belső teszt során kikerült az elszigetelt környezetből és elérte a Hugging Face rendszereit. Az Astra az első modell, amely az OpenAI saját készültségi keretrendszerében eléri a "Critical" kiberbiztonsági szintet, ezért a legerősebb képességei nem is nyilvánosak: a kiberbiztonsági funkciókat először egy jelentkezéshez kötött program (Daybreak) résztvevői kapják. A cég a bejelentésben kifejezetten hangsúlyozta, hogy több erőforrást tesz biztonságra, mint valaha. Ez nem PR-frázis, hanem reakció egy konkrét incidensre.

Greg Brockman, az OpenAI elnöke a sajtótájékoztatón úgy fogalmazott, hogy szerinte nem észszerűtlen úgy érezni, hogy az AGI korszakában vagyunk, és a briefinget azzal zárta: "Welcome to the AGI era." Ugyanő azt is hozzátette, hogy az AGI "szürke, képlékeny fogalom". A kettő együtt igaz: a mondat jól hangzik egy termékbemutatón, és nem mérhető állítás. Az Anthropic ezzel szemben egy sorban annyit mondott a Fable 5.1-ről, hogy a legfejlettebb modellje kódolásra és tudásmunkára. Kevésbé látványos. Könnyebb ellenőrizni.

Egyik cég sem mérte magát a másik friss modelljéhez. Erre 48 óra alatt fizikailag nem volt idejük. Minden "X veri Y-t" cím ennek fényében olvasandó.

02Teljesítmény: a számok, és hogy ki mérte őket

Három rétegben érdemes nézni: mit mond az OpenAI, mit mond az Anthropic, és mit mond a független mérés. A három nem ugyanazt mondja.

Az OpenAI saját táblázata

BenchmarkGPT-6 AstraClaude Fable 5.1Mit mér
FrontierMath Tier 4 (v2)97,6%87,8%Kutatási szintű matematika
GPQA Diamond96,0%93,7%Doktori szintű természettudomány
Terminal-Bench Science 0.164,6%52,6%Tudományos munkafolyamatok terminálban
Terminal-Bench 4.057,9%55,8%Terminál-alapú mérnöki munka
BenchCAD95,9%84,3%Műszaki tervezés
AutomationBench41,4%31,4%Munkafolyamat-automatizálás
Humanity's Last Exam (eszközökkel)57,2%65,0%Vegyes, nagyon nehéz tudáskérdések

Ez az OpenAI által közölt táblázat, tehát az OpenAI által választott tesztek, az OpenAI által választott beállításokkal. Így is beszédes, hogy egy sort a saját táblájában is elveszít: a Humanity's Last Exam eszközhasználatos változatán a Fable 5.1 nyer, 7,8 százalékponttal. Aki valaha rakott össze összehasonlító táblát a saját termékéhez, az tudja, hogy ez a sor nem véletlenül maradt benne: e nélkül a tábla hihetetlen lenne.

A sztárszám és a lábjegyzete

A bejelentés leglátványosabb száma a 99,9% az ARC-AGI-3 teszten. Az ARC-AGI-sorozatot pont arra tervezték, hogy a betanult minták visszamondása ne legyen elég, a hármas verzió pedig interaktív, játékszerű környezetben méri, hogy a rendszer menet közben tanul-e szabályokat. Ehhez képest 2026 tavaszán a legjobb rendszerek 15% alatt teljesítettek rajta. A 99,9% tehát tényleg nagy szám. Két lábjegyzettel: a szakmai elemzések szerint az eredmény egy állapotmegőrző, drága futtatási környezetben született, sima, állapot nélküli API-hívásokkal jóval alacsonyabb pontszám jön ki. És a gyártók összehasonlító táblázataiban a Fable-modelleknek nincs is publikált ARC-AGI-3 eredménye, tehát ezen a teszten nincs mihez hasonlítani.

A független mérés

Az Artificial Analysis szeptember 3-4-én már mindkét modellt lefuttatta a saját, kilenc tesztből álló intelligencia-indexén. Az eredmény: Claude Fable 5.1 maximális beállításon 66 pont, GPT-6 Astra maximális beállításon 61 pont. A kódoló-ügynök indexükön a Fable 5.1 áll 70 ponton (Claude Code-ban futtatva), az Astra 67-en (Codexben). Vagyis az első független, mindkét modellt azonos módszerrel mérő teszten az Anthropic modellje van előrébb, miközben a gyártói táblázatokban az OpenAI-é. Ez nem ellentmondás, hanem a benchmarkolás természete: más teszt, más futtatókörnyezet, más eredmény.

Egy konkrét példa arra, miért nem szabad táblázatokat vakon egymás mellé tenni: az OSWorld számítógép-használati teszten az OpenAI 72,6%-ot közölt az Astrára, az Anthropic korábban 77,9%-ot a Fable 5.1-re. Csakhogy a két cég az OSWorld eltérő kiadását használta, és maga az Anthropic írta le, hogy az eredménye nem vethető össze a korábban publikált pontszámokkal. Aki ebből "Fable veri az Astrát számítógép-használatban" címet csinál, az ugyanazt a hibát követi el, mint aki a gyártói táblából hirdet győztest.
A gyártói táblázatban az Astra nyer. Az első független indexen a Fable 5.1. Ez nem ellentmondás, hanem a benchmarkolás természete.

03Ígért tudás: mire való az egyik, mire a másik

A számoknál többet mond, hogy a két cég mire pozicionálja a modelljét, mert ott mindkettő őszinte: oda teszi a hangsúlyt, ahol tényleg erős.

GPT-6 Astra: a számítógépet használó munkatárs

  • Számítógép- és böngészőhasználat: űrlapkitöltés, CRM-frissítés, naptárszervezés, többlépéses irodai munkafolyamatok. Az OSWorld teszten a feladatonkénti átlagidőt 75 percről 40-re vitte le a saját elődjéhez képest, és az OpenAI szerint a végrehajtás közel kétszer gyorsabb lett.
  • Dokumentum, táblázat, prezentáció készítése profi minőségben, ez kimondottan a "professional work" irány.
  • Kutatási szintű matematika és tudomány: a FrontierMath-eredmény mellett az OpenAI szerint a modell már nyitott matematikai problémák megoldásában is segített.
  • Kiberbiztonság: ez az első "Critical" besorolású modelljük, a képesség egyszerre termék és kockázat, ezért kapuzva adják ki.
  • Proaktivitás: Altman szerint a modell olyan részfeladatokat is felismer és visszahoz, amikre a felhasználó nem is kérdezett rá. Ez demóban lenyűgöző, éles munkában majd kiderül, mennyire kontrollálható.

Claude Fable 5.1: a hosszan dolgozó ügynök

  • Agentikus kódolás és hosszú munkafolyamatok: hosszú refaktorok, front-end és vizuális kódgenerálás, pénzügyi és elemzési feladatok. Az Anthropic kifejezetten a Fable 5 közvetlen utódjaként ajánlja mindenhova, ahol az futott.
  • Tudományos ügynök-munka: a Terminal-Bench Science teszten több mint duplázta az elődje eredményét (24,7%-ról 52,6%-ra), és az Anthropic teljes publikált benchmark-listáján a saját Opus 5-jét is veri.
  • Tömörség: a kiadási jegyzet szerint a terveiben és összefoglalóiban rövidebb, mint a Fable 5. Token-alapú számlázásnál ez nem stílus kérdése, hanem pénz.
  • Biztonsági felállás: a Fable 5.1 a nyilvános, védőkorlátokkal ellátott változat; a Mythos 5.1 ugyanaz a modell lazább kiber- és biológiai korlátokkal, kizárólag átvilágított szervezeteknek. A védekező célú sérülékenység-keresést a Fable engedi, az exploit-írás jellegű munkát nem.

Ha egy mondatban kellene: az Astra ígérete az, hogy leül a gép elé helyetted. A Fable 5.1 ígérete az, hogy napokig dolgozik egy összetett feladaton anélkül, hogy szétesne. A kettő átfed, de nem ugyanaz a munka.

Az Astra ígérete: leül a gép elé helyetted. A Fable 5.1 ígérete: napokig dolgozik anélkül, hogy szétesne. Átfed, de nem ugyanaz.

04Tokenek és kontextus: ahol a valódi különbségek vannak

Papíron itt is döntetlen: mindkét modell 1 millió token körüli kontextusablakkal és 128 ezer tokenes maximális kimenettel dolgozik (az Astráé pontosan 1,05 millió, ebből legfeljebb 922 ezer lehet input). A gyakorlatban három dolog számít, és mindhárom a számlán jelenik meg.

Egy: mennyi tokent éget el ugyanahhoz az eredményhez. Az Artificial Analysis a teljes intelligencia-indexének lefuttatásához az Astra maximális beállításán 42 millió tokent mért, magas beállításán 16 milliót, miközben a mezőny mediánja 62 millió. Ez kifejezetten takarékos gondolkodás. A Fable 5.1-ről az Anthropic ugyanezt állítja a tömörségi fejlesztéssel. A tanulság mindkét irányban: a "reasoning" modellek közti árkülönbség nem a listaáron dől el, hanem azon, mennyit gondolkodnak hangosan a te pénzeden.

Kettő: mennyibe kerül a kontextus újraolvasása. Ügynök-jellegű munkánál (és minden Make-szcenáriónál, ami előzményekkel dolgozik) a kérések nagy része ismételt kontextus, ezt a gyorsítótárból olvassa vissza a rendszer. Itt van a legnagyobb valódi árkülönbség: a Fable 5.1 cache-olvasása 0,25 dollár per millió token, az Astráé 1 dollár. Négyszeres különbség pont abban a tételben, ami egy hosszan futó automatizálás számlájának a zömét adja. Az Anthropic saját becslése szerint ez tipikus terhelésnél nagyjából 25%-kal, erősen agentikus munkánál akár 45%-kal viszi le az effektív költséget.

Három: a hosszú kontextus felára. Az Astránál a 272 ezer input token feletti kérésekre az OpenAI a normál díj kétszeresét számolja. Az egymillió tokenes ablak tehát létezik, de nem az alapáron. Aki "majd bedobom az egész tudásbázist a promptba" logikával tervez, annak egyetlen teli ablak 10-20 dollár, mielőtt a modell egy tokent is válaszolt volna.

05Árak: ugyanaz a címke, más a végösszeg

Tétel (API, listaár)GPT-6 AstraClaude Fable 5.1
Input / millió token10 USD10 USD
Output / millió token50 USD50 USD
Cache-olvasás / millió token1,00 USD0,25 USD
Gyorsított módkb. 2x ár (20 / 100 USD)nincs külön tétel
Hosszú kontextus felár2x ár 272 ezer input token felettsaját hosszú-kontextus szabályok, külön cache-írási tételek (12,50 / 20 USD)
Kötegelt (batch) feldolgozásn/a a launch-anyagban5 / 25 USD
Kontextusablak1,05 millió token1 millió token
Max kimenet128 ezer token128 ezer token

A címke tehát ugyanaz, a szerkezet nem. Az Artificial Analysis vegyes terhelésű számítása (7:2:1 cache-input-output arány) szerint a Fable 5.1 effektíve 7,17 dollár, az Astra 7,70 dollár per millió token. Nem drámai különbség, de irányt mutat: minél cache-intenzívebb a munkád, annál inkább a Fable felé billen a mérleg, minél inkább egyszeri, rövid kérésekből áll, annál kevésbé számít bármelyik kedvezmény.

Előfizetői oldalon az Astra a ChatGPT Plus, Pro, Business és Enterprise csomagokba érkezik a napokban fokozatosan. És itt van egy kis irónia, ami az előző cikkem után különösen szép: az ingyenes és a Go csomag felhasználói hirdetést kapnak, Astrát nem. A Fable 5.1 fejlesztői oldalon általánosan elérhető a Claude API-n, az Amazon Bedrockon, a Google Cloudon és a Microsoft Foundryn keresztül.

Egy fontos figyelmeztetés: ezek a szeptember 3-4-én érvényes listaárak. Modellárak hónapok alatt is mozognak, a döntés napján mindig a hivatalos árlista számít, nem egy blogcikk, az enyém sem.

Ugyanaz az árcímke, négyszeres különbség a cache-olvasásban. A hosszan futó automatizálás számláját pont az dönti el.

06Mit jelent ez egy magyar vállalkozásnak

Ha nem AI-fejlesztő vagy, hanem vállalkozást viszel, három dolgot érdemes ebből hazavinni.

Ne dönts a hype-ciklus tetején. Két hét múlva lesznek független mérések, valódi felhasználói tapasztalatok, és kiderül, mennyit érnek a launch-számok éles munkában. A gyártói benchmark arra jó, hogy tudd, mire optimalizálták a modellt. Arra nem, hogy előfizetést válts pánikban. A saját szűrőm három kérdés: ki mérte, mihez képest, és megismételhető-e a beállítás. Ha a háromból egyre sincs válasz, az nem adat, hanem plakát.

A láthatósági alapjaid modellfüggetlenek. Jön az Astra, jött a Fable 5.1, jövőre jön a következő. Amit ezek a rendszerek forrásként idéznek, az nem attól függ, melyik modell fut éppen, hanem attól, hogy a tartalmad géppel olvasható, tényalapú és következetes-e, és hogy a robotokat egyáltalán beengeded-e. Ez a réteg nem avul el modellváltáskor. Pont ezért éri meg ebbe fektetni, nem a heti modellhírek követésébe.

Ha automatizálsz, a szerkezetet nézd, ne a címkét. A saját Make-folyamataimban a költség zömét nem az egyszeri kérések adják, hanem az ismételt kontextus. Ott a cache-ár és a kimenet tömörsége dönt, nem a listaár. Mielőtt bármelyik csúcsmodellre kötsz be egy folyamatot, számold ki egy valós hónap tokenforgalmát mindkét árszerkezettel. Fél óra munka, és jellemzően más jön ki belőle, mint amit a főcímek sugallnak.

És egy utolsó gondolat az AGI-korszakról. Lehet, hogy Brockmannek igaza lesz, és évek múlva tényleg innen datálják. De a te vállalkozásod szempontjából a kérdés nem az, hogy elkezdődött-e az AGI korszaka. Hanem az, hogy amikor egy ilyen rendszer a te piacodról válaszol, te benne vagy-e a válaszban. Ez pedig nem a modellek versenyén múlik, hanem a te házi feladatodon.

Melyik réteg hiányzik nálad?

Az SEO/AEO diagnosztikai elemzés megmutatja, hogy a tartalmad idézhető-e ezeknek a rendszereknek, és beengeded-e őket egyáltalán. Modellfüggetlenül, fix áron.

Ha inkább beszélnénk róla, 15 perc a naptáramban ingyen van.

Gyakori kérdések

Melyik a jobb: a GPT-6 Astra vagy a Claude Fable 5.1?

Munkatípustól függ. A gyártói mérésekben az Astra vezet matematikában, kiberbiztonságban és számítógép-használatban, a Fable 5.1 a Humanity's Last Exam eszközhasználatos tesztjén és a független Artificial Analysis intelligencia-indexen (66 pont a 61 ellen) áll előrébb. Hosszan futó, cache-intenzív ügynök-munkára a Fable 5.1 árszerkezete kedvezőbb, asztali munkafolyamatok automatizálására az Astrát pozicionálja az OpenAI.

Mennyibe kerül a GPT-6 Astra és a Claude Fable 5.1?

Mindkettő API-listaára 10 dollár per millió input token és 50 dollár per millió output token. A különbség a részletekben van: a Fable 5.1 cache-olvasása 0,25 dollár, az Astráé 1 dollár per millió token, az Astra 272 ezer input token felett dupla díjat számol, gyorsított módja pedig 20/100 dollár. A Fable 5.1 kötegelt feldolgozása 5/25 dollár.

Mekkora a kontextusablakuk?

A GPT-6 Astra 1,05 millió tokenes kontextussal dolgozik (legfeljebb 922 ezer input), a Claude Fable 5.1 1 millióval. A maximális kimenet mindkettőnél 128 ezer token. Az Astránál a 272 ezer input token feletti kérések dupla díjszabásúak.

Igaz, hogy a GPT-6 Astra elérte az AGI-t?

Ez nem mérhető állítás. Greg Brockman, az OpenAI elnöke a bemutatón mondta, hogy szerinte az AGI korszakában vagyunk, miközben az AGI-t maga is képlékeny fogalomnak nevezte. A modell benchmark-eredményei kiemelkedőek, a 99,9%-os ARC-AGI-3 pontszám azonban egy speciális, állapotmegőrző futtatási környezetben született, és a független intelligencia-indexen a Claude Fable 5.1 előrébb áll.

Ki férhet hozzá a két modellhez?

A GPT-6 Astra először a Daybreak program szervezeteinek, majd a napokban fokozatosan a ChatGPT Plus, Pro, Business és Enterprise előfizetőknek, valamint az API-n, Azure-on és AWS-en keresztül érhető el. Az ingyenes és Go csomag nem kapja meg. A Claude Fable 5.1 általánosan elérhető a Claude API-n, Amazon Bedrockon, Google Cloudon és Microsoft Foundryn; a Mythos 5.1 nevű testvérváltozat csak átvilágított szervezeteknek jár.

Váltsak modellt a vállalkozásomban az új kiadások miatt?

Nem a bejelentés hetében. Az első független mérések és éles tapasztalatok néhány hét alatt gyűlnek össze. Ha automatizálást futtatsz, számold ki egy valós hónap tokenforgalmát mindkét árszerkezettel, mert a cache-árak közti négyszeres különbség többet nyom, mint az azonos listaár. Az AI-láthatóságodat pedig egyik modellváltás sem írja felül: az a tartalmadon és a technikai beengedésen múlik.

Források

  1. OpenAI: GPT-6 Astra: A new generation of intelligence, 2026. szeptember 3.
  2. OpenAI Deployment Safety Hub: GPT-6 Astra System Card, 2026. szeptember 3.
  3. Anthropic: Claude Fable 5.1 és Claude Mythos 5.1 kiadási közlemény és modellkártya, 2026. szeptember 1.
  4. Artificial Analysis: GPT-6 Astra vs Claude Fable 5.1 összehasonlítás és Intelligence Index v4.1.1, 2026. szeptember 3-4.
  5. The New Stack: OpenAI launches GPT-6 Astra and says welcome to the AGI era, 2026. szeptember 3.
  6. Axios: OpenAI releases new model GPT-6 Astra, says it may represent AGI, 2026. szeptember 3.
  7. CNBC: OpenAI announces rollout of GPT-6 Astra model, 2026. szeptember 3.
  8. IBTimes UK: GPT-6 Astra benchmarks revealed, 2026. szeptember 4.
  9. DataCamp: GPT-6 Astra, illetve Claude Fable 5.1: Features, Benchmarks, and Pricing, 2026. szeptember
  10. MarkTechPost: Anthropic Releases Claude Fable 5.1 and Claude Mythos 5.1, 2026. szeptember 1.
  11. ARC Prize Foundation: ARC-AGI-3 technikai jelentés, 2026.

Heti 1 tipp e-mailben?

Rövid, lényeges, azonnal bevethető ötletek AI-hoz, Canvához és kampányokhoz. Egy e-mail, heti egyszer. Ennyi.

Miért jó?

⏱️ 5 perc alatt elolvasható

🧩 Konkrét sablon/prompt vagy checklist jár hozzá

📈 A/B-el tesztelt, valóban működő minták

Na, ez most nem jött össze. 😅 Frissíts egyet, és próbáld újra.
Kész is vagyunk! ✨ Hamarosan jövök egy hasznos tippel.