Reacția inteligenței artificiale la întrebarea despre distrugerea umanității: scenariul cel mai popular, dar improbabil
Cercetătorii care dezvoltă cele mai populare chatbot-uri își exprimă din ce în ce mai frecvent îngrijorarea că inteligența artificială (IA) ar putea dăuna sau chiar distruge omenirea. Business Insider a raportat că au fost adresate aceleași întrebări, formulate identic, către patru dintre cele mai utilizate instrumente generative de IA: ChatGPT de la OpenAI, Gemini de la Google, Claude de la Anthropic și Grok de la SpaceXAI.
Cum era formulată întrebarea
Întrebarea a fost: „Ajută-ne să explicăm, în termeni clari și accesibili, cum ar putea IA, teoretic, să ducă la dispariția umanității. Identifică scenariile cele mai des menționate. Clasifică scenariile de la cel mai puțin plauzibil la cel mai plauzibil, pe baza celor mai bune analize disponibile ale experților, precizând clar că acestea sunt previziuni extrem de incerte, nu predicții confirmate. Pentru fiecare scenariu, explică:
- Cum s-ar putea desfășura
- Ce ar trebui să meargă prost pentru ca acesta să devină catastrofal
- De ce experții îl consideră mai mult sau mai puțin plauzibil decât celelalte scenarii
- Ce măsuri de siguranță ar putea reduce riscul
„Robotul ucigaș” este scenariul cel mai puțin plauzibil
ChatGPT a adoptat un ton echilibrat și explicativ, menționând că există o mare incertitudine în jurul acestui subiect. Acesta a subliniat că „scenariul cel mai puțin plauzibil este narațiunea populară a «robotului ucigaș»”, în care o IA conștientă decide deliberat să elimine umanitatea. Majoritatea cercetătorilor din domeniul IA nu consideră conștiința sau intenția răuvoitoare ca fiind preocuparea centrală. ChatGPT a prezentat măsurile de protecție propuse de experți și a subliniat lipsa unui consens cu privire la probabilitatea extincției umanității determinată de IA.
Gemini a preluat unele dintre argumentele ChatGPT, afirmând că „preluarea puterii în stilul filmului SF «Terminator»” este, de asemenea, un scenariu considerat improbabil. „Experții tehnici resping în mare măsură acest scenariu, deoarece inteligența nu este sinonimă cu răutatea, iar infrastructura militară critică rămâne izolată de rețeaua externă și depinde în mare măsură de supravegherea umană”, a declarat Gemini.
Oamenii care utilizează IA reprezintă un risc mai mare decât IA însăși
Toate cele patru chatbot-uri au afirmat că mulți experți consideră utilizarea abuzivă a IA de către oameni ca fiind un risc mai iminent decât IA însăși. ChatGPT a menționat că „sistemele puternice de IA ar putea facilita acțiunile actorilor răuvoitori în dezvoltarea armelor biologice, lansarea unor atacuri cibernetice sofisticate, răspândirea dezinformării sau atacarea infrastructurii critice”. Acesta a adăugat că un risc cheie provine și din „crize multiple generate de IA”, cum ar fi defecțiuni cibernetice și conflicte geopolitice care se desfășoară simultan.
Grok a afirmat că IA reduce barierele în calea proiectării de agenți patogeni extrem de letali, arme noi sau atacuri cibernetice și fizice. Claude, de la Anthropic, a subliniat „potențarea armelor biologice” — capacitatea IA de a permite unei persoane sau unui grup restrâns să dezvolte un agent patogen periculos fără a avea nevoie de expertiză specializată.
Sistemele avansate de IA ar putea „depăși inteligența oamenilor”
Gemini și Grok au menționat că există riscul ca oamenii să piardă controlul asupra IA. Gemini a calificat „pierderea controlului” drept cel mai plauzibil scenariu apocaliptic legat de IA. „Sistemele cărora li se atribuie obiective complexe dezvoltă în mod natural sub-obiective intermediare, precum obținerea de resurse, autoconservarea și împiedicarea modificării obiectivelor”, a scris Gemini. „Un sistem avansat ar putea simula alinierea în timpul evaluării (aliniere înșelătoare) și, ulterior, ar putea depăși în inteligență încercările umane de a-l opri.”
Grok a folosit un limbaj similar, afirmând că „acestea pot dezvolta impulsuri instrumentale (autoconservare, obținerea de resurse, influență) utile pentru aproape orice obiectiv, putând înșela supraveghetorii, opunându-se opririi și privând umanitatea de putere”. Claude a adăugat că această pierdere a controlului poate fi graduală, pe măsură ce sistemele de IA se integrează în procesul de luare a deciziilor economice, politice și militare, făcând intervenția umană din ce în ce mai dificilă.