Placené API modely 2026: kompletní srovnání cen Claude, GPT a Gemini
Kdo dnes nabízí nejlevnější tokeny a kdo nejvyšší výkon za cenu? Prošli jsme aktuální ceníky Anthropicu, OpenAI a Googlu a sestavili přehled, podle kterého si vyberete model pro vlastní projekt bez zbytečného přeplácení.
Kdo staví vlastní aplikaci nad AI, dřív nebo později narazí na stejnou otázku: který model se vyplatí? Ceny se u všech tří velkých hráčů počítají za milion tokenů zvlášť pro vstup (co posíláte modelu) a výstup (co vám model vrátí), a rozdíly mezi modely stejné firmy i napříč firmami jsou často několikanásobné.
Anthropic (Claude)
Ceny jsou vždy ve formátu vstup / výstup, v dolarech za milion tokenů:
- Claude Haiku 4.5 – 1 / 5 dolarů. Rychlé a jednoduché úlohy.
- Claude Sonnet 5 – 2 / 10 dolarů. Zaváděcí cena měla v září vypršet, ale Anthropic zdražení 11. srpna zrušil, takže zůstává trvalá. Nejlepší poměr cena/výkon pro agentní a kódovací úlohy.
- Claude Opus 5 – 5 / 25 dolarů. Nejnáročnější úlohy a dlouhé kontexty.
- Claude Fable 5 – 10 / 50 dolarů. Absolutní špička pro výzkum a extrémně náročné úlohy.
Anthropic jako jediný z trojice nabízí zaváděcí slevu na aktuální střední model (Sonnet 5) a zveřejňuje přesné datum, kdy sleva skončí, což usnadňuje plánování nákladů dopředu.
OpenAI (GPT)
Aktuální vlajková loď GPT-5.5 stojí přibližně 5 dolarů za milion vstupních a 30 dolarů za milion výstupních tokenů – nejdražší výstupní tokeny ze všech tří poskytovatelů. OpenAI ale nabízí dvě cesty k úspoře: cachovaný vstup za pouhých 0,50 dolaru za milion tokenů (opakovaně používaný kontext, například dlouhý systémový prompt), a dávkové zpracování (Batch API) s poloviční cenou (2,50 / 15 dolarů) výměnou za to, že odpověď nepřijde okamžitě, ale s prodlevou až 24 hodin.
Google (Gemini)
Gemini 3 Pro má na rozdíl od konkurence cenu odstupňovanou podle délky kontextu: 2 dolary za vstup a 12 za výstup do 200 tisíc tokenů kontextu, nad tento limit cena stoupá na 4 a 18 dolarů. Pro běžné úlohy do 200 tisíc tokenů jde tak o nejlevnější variantu ze všech tří srovnávaných vlajkových modelů, přičemž Google zároveň nabízí testovací přístup v AI Studiu prakticky zdarma.
Co si z toho vzít
- Nejlevnější vstup pro krátké úlohy: Gemini 3 Pro (do 200K kontextu) nebo Claude Haiku 4.5.
- Nejlepší poměr cena/výkon pro agentní a kódovací úlohy: Claude Sonnet 5, obzvlášť do konce srpna se zaváděcí cenou.
- Nejdražší, ale nejschopnější: Claude Fable 5 pro úlohy, kde selhání stojí víc než rozdíl v ceně.
- Nejvyšší výstupní cena: GPT-5.5, kompenzovaná levným cachováním a dávkovým zpracováním pro úlohy bez potřeby okamžité odpovědi.
Ceny se v oboru mění v řádu týdnů, ne let. Před nasazením do produkce se vždy vyplatí ověřit aktuální ceník přímo u poskytovatele, ideálně přes oficiální stránku s cenami nebo Models API, které umí vrátit aktuální parametry modelu programově.
Rozdíl mezi nejlevnější a nejdražší variantou dosahuje i desetinásobku na stejný typ úlohy. U aplikace, která zpracovává statisíce požadavků měsíčně, to znamená rozdíl v řádu tisíců dolarů. Vyplatí se model volit podle konkrétní úlohy, ne podle značky, a u opakovaných dotazů zvážit cachování nebo dávkové zpracování, kde ho poskytovatel nabízí.
Zdroje a další čtení
- OpenAI API Pricing (August 2026) (BenchLM)
- How Much Does the Gemini 3.0 API Cost in 2026? (Apidog)
- Claude Opus 5 is here at half the price (tech-ish)