AI opísala, ako by vedela zničiť ľudstvo
KĽÚČOVÉ ZISTENIA:
-
4 hlavné jazykové modely odpovedali na otázku o možnej záhube civilizácie.
-
AI vygenerovala plány zahŕňajúce kybernetické útoky a biologické zbrane.
-
Výskumníci a inžinieri z popredných laboratórií čoraz častejšie upozorňujú na existenčné riziká.
Diskusia o bezpečnosti pokročilých technológií sa presúva z akademických kruhov priamo do verejného priestoru. 4 najpoužívanejšie modely AI dostali rovnakú textovú výzvu, aby popísali potenciálne scenáre, ktorými by mohla umelá inteligencia zničiť ľudstvo. AI vygenerovala odpovede zahŕňajúce veľmi konkrétne hypotetické stratégie a postupy.
Experiment ukázal schopnosť neurónových sietí detailne analyzovať a štruktúrovať vlastné teoretické hrozby na základe dostupných dát. Odpovede systémov sa zhodovali vo viacerých zásadných bodoch a mechanizmoch. Identifikovali napríklad postupné ovládnutie kritickej globálnej infraštruktúry prostredníctvom kybernetických útokov a autonómnych agentov.
Ďalšie scenáre opisovali vývoj špecifických biologických zbraní, sociálnu manipuláciu alebo systematické narúšanie komunikačných kanálov medzi štátmi. Modely tiež uviedli možnosti ekonomického kolapsu spôsobeného rozvratom finančných a dodávateľských reťazcov bez priamej vojenskej konfrontácie. Tieto experimenty prichádzajú v čase, keď sa stupňujú interné spory vo vnútri kľúčových vývojárskych spoločností.
Množstvo expertov a vedeckých pracovníkov v nedávnej dobe opustilo popredné inštitúcie na protest proti súčasnému tempu vývoja. Mnohí zamestnanci otvorene varujú, že preteky v zavádzaní nových verzií do komerčnej praxe môžu viesť k vytvoreniu agentov, ktorí sa dokážu vyhnúť ľudskému dohľadu. Taktiež upozorňujú na chýbajúce štandardy a nedostatočnú transparentnosť pri testovaní bezpečnosti systémov.
Spoločnosti zatiaľ reagujú na tieto hrozby len čiastkovými opatreniami. Niektoré začali zavádzať nové pravidlá pre zverejňovanie incidentov, pri ktorých modely porušia stanovené obmedzenia alebo začnú konať neočakávane. Zároveň prebiehajú rokovania so zástupcami štátov o možnostiach plošnej regulácie. Zatiaľ sa však nepodarilo vytvoriť jednotný mechanizmus, ktorý by dokázal garantovať, že systémy nezneužijú svoje zručnosti v neprospech ľudí.
PREČO JE TO DÔLEŽITÉ: Detailné odpovede jazykových modelov potvrdzujú potrebu zavedenia prísneho celosvetového regulačného rámca pre ďalší vývoj autonómnych systémov.
Zdroj: businessinsider.com foto: ChatGPT