Ceny API modelů po zářijové vlně: kde se vyplatí GPT-6, Fable 5.1 a Gemini
Zářijová vlna nových modelů zamíchala ceníky. Aktualizovali jsme přehled placených API modelů o GPT-6 Astra, Claude Fable 5.1 a nejnovější Gemini, včetně toho, které zdražení nakonec neproběhlo.
Před měsícem jsme srovnávali ceny placených API modelů. Za tu dobu přibyly tři novinky a jedna cena se změnila jinak, než se čekalo. Tady je aktualizovaný přehled. Ceny jsou vždy ve formátu vstup / výstup, v dolarech za milion tokenů.
Anthropic (Claude)
- Claude Haiku 4.5 – 1 / 5 dolarů. Rychlé a jednoduché úlohy.
- Claude Sonnet 5 – 2 / 10 dolarů. Zaváděcí cena se měla v září zvednout, ale Anthropic zdražení 11. srpna zrušil, takže 2 / 10 zůstává trvale. Nejlepší poměr cena/výkon.
- Claude Opus 5 – 5 / 25 dolarů. Náročné úlohy a dlouhé kontexty.
- Claude Fable 5.1 – 10 / 50 dolarů. Absolutní špička. Novinka: cena za čtení z cache spadla na 25 centů za milion tokenů, tedy o 75 % oproti Fable 5, což u dlouhých agentních úloh výrazně snižuje reálný účet.
OpenAI (GPT)
Nová vlajková loď GPT-6 Astra je od 3. září dostupná v placených tarifech ChatGPT i přes API a AWS. Přesný ceník se u čerstvě vydaného modelu ještě ustaluje, obvykle se ale pohybuje na úrovni předchozí generace nebo mírně nad ní. Astra je nejsilnější na počítačovém ovládání, softwarovém inženýrství a odborné práci, ale komerční verze má kvůli kyberschopnostem omezené některé pokročilé funkce. Předchozí GPT-5.5 za zhruba 5 / 30 dolarů zůstává levnější variantou pro úlohy, které špičku Astry nepotřebují.
Google (Gemini)
Gemini 3.8 Flash je nejnovější z rychlé řady a míří na poměr cena/výkon: rychlý, levný a přesto schopný na kódování a agenty. Přesná cena se u Flash řady drží nízko a Google ji u nových verzí zpravidla ještě snižuje (u předchozího 3.7 Flash to byla polovina ceny předchůdce). Skutečně drahý frontier model Google zatím nenabízí, takže pokud hledáte nejvyšší ligu, volíte mezi Claude a GPT.
Co si z toho vzít
- Nejlevnější kvalitní model pro běžné úlohy: Gemini Flash řada nebo Claude Sonnet 5.
- Nejlepší poměr pro agentní a kódovací práci: Claude Sonnet 5, u dlouhých úloh s Fable 5.1 díky levné cache.
- Absolutní špička výkonu: GPT-6 Astra nebo Claude Fable 5.1, podle toho, co se vám lépe používá.
- Zlaté pravidlo zůstává: ceny se mění v řádu týdnů. Před nasazením do produkce vždy ověřte aktuální ceník přímo u poskytovatele.
Za jediný měsíc se změnily tři z pěti nejsledovanějších ceníků. Kdo staví aplikaci nad AI, potřebuje ceny brát jako pohyblivý cíl, ne jako konstantu. Zaváděcí slevy, jejich rušení i plánovaná zdražení mohou u aplikace se statisíci požadavků měsíčně znamenat rozdíl v řádu tisíců dolarů.
Zdroje a další čtení
- GPT-6 Astra: Release Date, Pricing, Benchmarks, and Rollout (Yotta Labs)
- Claude Fable 5.1 API Pricing, Context Window & Benchmarks (llm-stats)
- Best AI Models in September 2026 (Fello AI)