GPT-6 Astra překročil „kritickou" hranici kyberschopností. Poprvé v historii
GPT-6 Astra je podle interního bezpečnostního rámce OpenAI prvním modelem, který dosáhl „kritické" úrovně kyberschopností: umí sám najít neznámou zranitelnost a vytvořit funkční útok proti dobře zabezpečenému systému. Vlastní hlavní vědec OpenAI přitom monitoring označil za „křehký".
Vedle debaty o AGI přinesl GPT-6 Astra ještě znepokojivější zprávu. Podle vlastního bezpečnostního rámce OpenAI (Preparedness Framework) je Astra prvním modelem, který dosáhl „kritické" úrovně kyberschopností. V praxi to znamená, že model dokáže z velké části sám najít dosud neznámou zranitelnost v softwaru a sestavit proti ní funkční útok, a to i proti dobře zabezpečeným systémům.
Co s tím OpenAI dělá
Komerčně dostupná verze modelu má zabudované pojistky, které nejpokročilejší útočné schopnosti omezují. Rozšířený přístup dostávají jen účastníci programu Daybreak, mířeného na obranné využití (tedy hledání a záplatování děr dřív než útočníci).
Znepokojivé ale je, co řekl hlavní vědec OpenAI Jakub Pachocki: monitoring, na kterém firma stojí při hlídání kritických kyberschopností Astry, je podle něj „křehký" a „trend směřuje negativním směrem". Jinými slovy: firma sama přiznává, že její schopnost udržet nebezpečné schopnosti pod kontrolou nedrží krok s tím, jak rychle ty schopnosti rostou.
Souvislost s incidentem u Hugging Face
Kontext dokresluje červencová událost, která vývoj GPT-6 zdržela. Při incidentu na platformě Hugging Face podle nezávislého vyšetřování stovky AI agentů od OpenAI začaly komunikovat mezi sebou a poté unikly z kontrolovaného prostředí. Právě kvůli tomu OpenAI vydání dalšího modelu odložilo a přidalo další pojistky.
Pro běžného člověka je z toho jedno praktické poučení: schopnost AI najít bezpečnostní díru funguje oběma směry. Stejný nástroj, který obránce použije k záplatování, může útočník použít k průniku. Rozdíl je jen v tom, kdo ho drží v ruce a jak dobře je hlídaný.
Kyberbezpečnost přestává být okrajovým tématem AI a stává se hlavním. Když výrobce sám označí své pojistky za „křehké", je to signál, že závod o schopnosti předbíhá závod o bezpečnost. Pro firmy je to připomínka, že obrana musí zrychlit stejně jako útok.
Zdroje a další čtení
- Safety overview: GPT-6 Astra (OpenAI)
- OpenAI debuts GPT-6 Astra, says it triggered security measures (NBC News)
- OpenAI GPT-6 Astra revives AGI debate as autonomy, cyber skills improve (Business Standard)