OpenAI, Anthropic a Google jednaly v Bílém domě o testování bezpečnosti AI
Zástupci tří největších AI laboratoří se sešli s americkou vládou kvůli návrhu rámce pro dobrovolné bezpečnostní testy modelů. Jednání přišlo necelé dva měsíce po epizodě s vypnutím Claude Fable 5 kvůli exportním kontrolám.
Začátkem srpna hostila Trumpova administrativa v Bílém domě zástupce OpenAI, Anthropicu a Googlu. Tématem bylo nastavení nového rámce pro dobrovolné bezpečnostní testy AI modelů před jejich veřejným vydáním.
Podrobnosti navrhovaného rámce zatím nejsou veřejné, ale kontext dává jednání smysl: v červnu americká vláda exportní směrnicí donutila Anthropic na 19 dní vypnout přístup k modelu Fable 5 kvůli obavám o zneužití k útokům na softwarová zranitelnosti. Dobrovolný rámec testování je patrně pokusem najít cestu mezi dvěma extrémy: nekontrolovaným vydáváním čím dál schopnějších modelů, a ad hoc zásahy typu červnové exportní směrnice, které firmám i uživatelům bez varování vezmou přístup k modelu.
Pro firmy stavějící produkty na těchto modelech je klíčová otázka, jak takový rámec ovlivní předvídatelnost dostupnosti modelů. Zatímco dosavadní bezpečnostní opatření (guardrails, klasifikátory rizikového obsahu) fungují uvnitř běžícího modelu, direktivní zásah shora může model vyřadit z provozu celý, bez ohledu na to, jak ho konkrétní firma používá.
Ať dobrovolný rámec dopadne jakkoli, ukazuje jasný trend: bezpečnost nejschopnějších AI modelů přestává být čistě firemní rozhodnutí a stává se předmětem vládní politiky. Firmy závislé na jediném poskytovateli frontier modelu by měly mít plán B pro případ, že se podobná epizoda jako u Fable 5 zopakuje.