„Vítejte v éře AGI." OpenAI vydal GPT-6 Astra a rozpoutal spor
OpenAI 3. září představil GPT-6 Astra a jeho prezident Greg Brockman uzavřel tiskovou konferenci slovy „Vítejte v éře AGI". Jenže nezávislá organizace, která stojí za hlavním benchmarkem, vzápětí zveřejnila skóre o 37 procentních bodů nižší, než uvedla OpenAI.
OpenAI vydal GPT-6 Astra, model, který sám popisuje jako „nejinteligentnější a nejlépe zarovnaný" na světě. Podle firmy dosahuje špičkových výsledků na počítačovém ovládání, prohlížení webu, softwarovém inženýrství, vědě i odborné práci a překonává jak předchozí GPT-5.6 Sol, tak konkurenční Claude Fable 5.
Nejvíc pozornosti ale vzbudila slova prezidenta OpenAI Grega Brockmana, který tiskovou konferenci uzavřel prohlášením: „Vítejte v éře AGI." AGI, tedy umělá obecná inteligence schopná zvládnout jakoukoli intelektuální úlohu na lidské úrovni, je dlouhodobým deklarovaným cílem oboru. K tvrzení se přidal i šéf Nvidie Jensen Huang, který na síti X napsal „AGI dorazila".
Kde je háček
Tvrzení naráží na tvrdá čísla. Nezávislá organizace, která postavila hlavní benchmark použitý při prezentaci, krátce po oznámení zveřejnila u téhož testu skóre o 37 procentních bodů nižší, než jaké uvedla OpenAI. Rozdíl takového rozsahu není zaokrouhlovací chyba, ale zásadní rozpor v tom, jak se výsledek měřil.
OpenAI mimochodem samo v launch materiálech AGI formálně netvrdí. Prohlášení padlo z úst prezidenta na tiskovce, ne v oficiální dokumentaci. To je důležitý rozdíl: mezi marketingovým nadšením a doložitelným faktem je propast, kterou by čtenář neměl přeskočit.
Jak to číst
Historie AI je plná okamžiků, kdy někdo prohlásil, že „tohle je ono". Zatím pokaždé se ukázalo, že hranice AGI je dál, než se zdálo. GPT-6 Astra je bezpochyby velmi schopný model, ale mezi „velmi schopný" a „obecná inteligence na lidské úrovni" je rozdíl, který jeden benchmark ani jedna tisková konference nerozhodnou.
AGI je pojem, který prodává titulky a zvedá akcie, ale nemá dohodnutou definici ani měřítko. Když příště uslyšíte „AGI dorazila", vyplatí se ptát: podle koho, změřeno jak a kdo to nezávisle ověřil? U GPT-6 Astra byla odpověď na poslední otázku nepříjemná už druhý den.