AI aktuality6. září 2026 · 6 min čtení

GPT-6 Astra je venku: k dispozici i v Codexu a ChatGPT Work

OpenAI vypustilo GPT-6 Astra a během dvou dnů ji dostali všichni platící uživatelé. Nejlíp ze všech špičkových modelů ovládá počítač, na testech souhrnné inteligence ale nepřidala ani bod. Co z toho plyne pro běžnou práci?

GPT-6 Astra je venku: k dispozici i v Codexu a ChatGPT Work

🎧 Poslechnout článek

8:15

Namluveno mým hlasem přes AI

OpenAI vypustilo GPT-6 Astra, nový vlajkový model nad celou řadou GPT-5.6. Ve čtvrtek 3. září ji dostala jen hrstka vybraných organizací, v pátek naskočila do Codexu a do agenta ChatGPT Work a ještě týž večer ji měl každý na placeném plánu ChatGPT.

Model v tiskové zprávě je jedna věc. Model v nástroji, kde reálně pracujete, druhá.

Tak předně: přes API je 2,5× dražší než GPT-5.6 Sol

Přes API stojí 10 dolarů za milion vstupních a 50 za milion výstupních tokenů. To je 2,5× víc než dosavadní vlajkový model GPT-5.6 Sol, který je v akci za 4 resp. 20 dolarů, a to minimálně do 21. listopadu.

Pokud platíte předplatné, nedáte za Astru nic navíc, jen vám rychleji ubývají kredity. Na bezplatném plánu a na Go ji nenajdete, tam běží dál nejlevnější Luna.

Základní parametry nového modelu GPT-6 Astra:

  • Kontextové okno 1,05 milionu tokenů, výstup až 128 tisíc.
  • Znalosti natrénované do 30. dubna 2026.
  • Parametr effort od low po max, kterým modelu řeknete, jak moc se má snažit. Vyšší nastavení znamená obvykle lepší výsledek za cenu větší spotřeby tokenů.
  • V Codexu si Astra drží poznámky napříč kontextovými okny, místo aby si dokola shrnovala, co už udělala. To by mohlo mít největší dopad na zefektivnění práce největšího počtu lidí.

Největší skok není v ovládání počítače, ale v terminálu

OpenAI staví launch kolem ovládání počítače. Když si ale její vlastní tabulku seřadíte podle toho, kde je proti GPT-5.6 Sol největší posun, ovládání počítače spadne až do druhé poloviny. Vybral jsem sedm čísel, o která jde:

BenchmarkCo měříAstra5.6 Sol
ARC-AGI-3naučí se neznámou hru bez instrukcí99,9 %7,8 %
Terminal-Bench Science 0.1vědecká práce v příkazové řádce64,6 %22,4 %
AutomationBenchautomatizace kancelářských postupů41,4 %18,1 %
Terminal-Bench 4.0programování a konfigurace v terminálu57,9 %37,3 %
ScreenSpot-Protrefí kliknutím správný prvek na obrazovce92,7 %76,9 %
OSWorld 2.0práce v desktopových aplikacích72,6 %65,7 %
DeepSWE v1.1opravy reálných chyb v repozitářích74,1 %72,7 %

Tolik benchmarky výrobce, které musíme brát vždy v uvozovkách. Hlavně proto, že je to skok proti vlastnímu předchůdci, ne proti konkurenci. Na nezávislém žebříčku Terminal-Bench má Astra 58,2 % a Claude Fable 5.1 57,9 %, a protože se jim překrývají intervaly spolehlivosti, je to statistická remíza. Na OSWorldu má Claude Opus 5 70,2 %, tedy jen 2,4 bodu za Astrou. A na Humanity's Last Exam, sadě nejtěžších otázek napříč obory, Astra prohrává s Fable 5.1 o skoro osm bodů, 57,2 proti 65,0 %.

Konkrétní příklad z praxe má Ethan Mollick, který nové modely testuje mezi prvními. Nechal Astru pět dní bez zásahu číst desetitisíce svých e-mailů, textů a záznamů v kalendáři a postavit z toho osobní znalostní bázi. Sám k tomu ale poctivě dodává, že mu OpenAI po dobu testování neúčtovala tokeny, takže netuší, kolik by to stálo. Pravděpodobně dost.

Na testu souhrnné inteligence je na tom stejně jako předchozí vlajka

Lepší data nám poskytuje nezávislý souhrnný index inteligence od Artificial Analysis, kde Astra získala 61 bodů, tedy úplně stejně jako o generaci starší a 2,5× levnější GPT-5.6 Sol.

Souhrnná inteligence dnešní špičky (Artificial Analysis Intelligence Index, vyšší = lepší)

Artificial Analysis Intelligence Index v4.1.1, hodnoty odečtené 4. 9. 2026.

Nad Astrou jsou oba velké modely od Anthropicu a stejných 61 bodů má i výrazně levnější Grok. Nová generace tedy neznamená chytřejší model na všechno. Zřejmě přináší primárně vyšší rychlost, samostatnost a schopnost odpracovat dlouhou úlohu v terminálu.

Jakub Kychler k tomu přidává, že podle odhadu Artificial Analysis vyjde jedna úloha na Astře zhruba o 75 % dráž než na Solu. A to je podle mě klíčové. Zdá se mi, že nás Anthropic i OpenAI tlačí pomalými kousky k tomu, abychom jim platili mnohem víc peněz, i když přímo nezdražují předplatné.

Astra se vyplatí tam, kde má něco odpracovat, ne tam, kde má něco vymyslet.

Stejný model dá 62,7 %, nebo 99,9 %. Rozdíl dělá harness

Vraťte se na první řádek tabulky výš. Těch 99,9 % na ARC-AGI-3 je číslo, které uvádí OpenAI. Když ale tentýž test spustí standardním harnessem organizace ARC Prize, dá Astra 62,7 %. Stejný model, rozdíl 37 procentních bodů.

Není to překlep. U dnešních modelů se neměří jenom model, ale i harness: celá ta obálka kolem něj, tedy jaké dostane nástroje, kolik pokusů a jak se mu předá zadání. Tentýž model vyjde jednou jako průměr a podruhé jako zázrak.

Proto se benchmarkům nedá věřit na slovo.

Co si z toho vzít

Ve feedu na YouTube a LinkedInu to bude zase vypadat jako revoluce. Ta v AI přichází prakticky každý týden. Podle mě jde ale o další evoluci modelu, o konkurenční boj a o postupné zvyšování útrat: cestou většího spendu tokenů, který část lidí dovede k dokoupení dalšího předplatného.

Mnohem podstatnější je, co s AI děláte. Jaký úkol jí zadáváte. Jestli je to něco, co řeší reálný problém, může to vám nebo vašim zákazníkům přinést podstatnou hodnotu, nebo naopak ušetřit nezanedbatelné prostředky. A na to si odpovězte sami. Pracujete na něčem takovém? Nebo hledáte lék v nové nablýskané technologii?

Přesně tohle učím ve svém kurzu AI First. Naučím vás myslet AI First a řešit problémy tímhle způsobem. K tomu konkrétní postupy, jak pomocí vibe codingu vytvářet weby a aplikace, nastavovat analytiku nebo řídit marketingové kanály. 23 hodin praxe, žádná teorie, připojilo se už 1 800+ lidí.

Mrkněte na kurz AI First a naučte se ždímat maximum z každého modelu, co je zrovna nahoře. ⚡


Související

Než se do nového modelu pustíte, hodí se mít jasno v základech:

Předchozí modely jsem rozebíral tady: GPT-5.6 a Claude Opus 5.