Plán na záchranu: Vedci zverejnili manuál, aby prežilo ľudstvo
Vedci, po rokoch výziev a varovaní, predstavili konkrétny a rozsiahly plán na záchranu, ktorý nazvali dokumentom „AI 2040: Plan A“. Tento viac než dvestostranový materiál je výsledkom práce výskumnej skupiny AI Futures Project, ktorá má za cieľ spomaliť exponenciálny rozvoj umelej inteligencie a zabrániť vzniku superinteligencie, ktorá by mohla uniknúť kontrole.
V čele iniciatívy stojí Daniel Kokotajl, bývalý výskumník v organizácii OpenAI, ktorý v roku 2024 opustil svoju pozíciu kvôli obavám o etiku a smerovanie firmy. Skupina je známa aj svojím predchádzajúcim modelom AI 2027, ktorý varoval pred potenciálnym nebezpečenstvom nekontrolovaného rozvoja AI.
Nový plán, na rozdiel od jeho predchodcu, ponúka optimistickejší pohľad na budúcnosť a nie je iba diskusiou o predpokladaných scenároch, ale konkrétnym plánom opatrení, ktoré by mali zabezpečiť zosúladenie umelej inteligencie s ľudskými hodnotami.
Zmluva s Čínou do roku 2029
V dokumente autori navrhujú do roku 2029 uzatvoriť medzinárodnú dohodu o transparentnosti vo všetkých oblastiach výskumu umelej inteligencie medzi Spojenými štátmi a Čínou. Navrhujú, aby zmluva nebola založená len na politickej dôvere, ale na vzájomnom monitorovaní hardvéru, ktorý je nevyhnutný pre vývoj špičkovej AI.
Keďže vývoj komplexnej umelej inteligencie si vyžaduje značné investície do energeticky náročných dátových centier, autori veria, že je možné efektívne sledovať využitie výpočtových výkonov a vyžadovať verejnosť všetkých laboratórnych experimentov, modelov a architektúr.
Regulácia AI: Medzi rokom 2030 a 2035
Druhá fáza plánu sa zameriava na obmedzenie schopností modelov umelej inteligencie do úrovne „ľudského génia“ medzi rokmi 2030 a 2035. AI by mala dosiahnuť úroveň expertov v rôznych oblastiach, no jej rozvoj by mal byť limitovaný, aby sa predišlo nekontrolovateľnému sebazlepšovaniu.
Až do roku 2040 by mal byť ďalší vývoj voči autonómnym superinteligentným systémom zastavený, čo by výskumníkom umožnilo dostatok času na prácu na zásadnej otázke zosúladenia AI s hodnotami ľudstva a na prispôsobenie inštitúcií na predpokladanú transformáciu spoločnosti.
Občianska dividenda a zníženie pracovných miest
Plán predpokladá, že nasledujúca fáza po roku 2040 by už mala zahŕňať riadené a bezpečné nasadenie superinteligentných systémov, čo bude nevyhnutne viesť spoločnosť k precho pordinálnej transformácii. Jedným z návrhov je koncept „občianskej dividendy“, ktorá by financovala univerzálny základný príjem pre všetkých občanov ziskami generovanými automatizáciou.
Princíp „vzájomne zaručeného zničenia”
Na zabezpečenie dodržiavania dohovoru a predchádzania porušeniu pravidiel navrhujú autori aplikovať mechanizmus „vzájomne zaručeného zničenia výpočtov“. Tento princíp, inšpirovaný z logiky jadrového odstrašovania, by umožnil zničiť infraštruktúru tých, ktorí by podvádzali a trénovali nezákonné modely umelej inteligencie cez dohodnuté limity.
Autori zároveň priznávajú, že úplné zabezpečenie nebude možné, avšak kombináciou hardvérovej kontroly, neohlásených inšpekcií a silné ochranou informátorov by mala byť dosiahnutá dostatočná miera dôvery.
Kritické posúdenie plánu
Kým niektorí odborníci, ako Nate Soares, považujú Plán A za najlepšie spracovanú víziu pozitívnej budúcnosti v oblasti regulácie AI, iní vyjadrujú obavy z geopolitickej naivity, varujúc pred vnútropolitickými otrasmi v USA a Číne, ktoré by mohli sťažiť spoluprácu a dohody.
Medzi inými rozšíreniami tematiku regulácie umelej inteligencie sa aj generálny riaditeľ Google DeepMind Demis Hassabis vyjadril k potrebe vytvorenia nových pravidiel na bezpečný vývoj umelej inteligencie, avšak bez volania po medzinárodných dohodách.

