Inteligența artificială ar putea amenința omenirea în următorul deceniu. Un cercetător estimează un risc de peste 10%

Inteligența artificială ar putea amenința omenirea în următorul deceniu. Un cercetător estimează un risc de peste 10%
Inteligența artificială ar putea amenința omenirea în următorul deceniu. Foto: Magnific
Temerile privind siguranța sistemelor de inteligență artificială și posibilitatea ca acestea să ducă la dispariția omenirii au atras din nou atenția pe rețelele sociale în această săptămână.

Evan Hubinger, coordonator al unei echipe care se ocupă de alinierea sistemelor AI în cadrul Anthropic, a afirmat pe platforma X că estimează la peste 10% probabilitatea ca inteligența artificială să provoace moartea tuturor oamenilor în următorul deceniu. Declarația a venit după ce unul dintre colegii săi a demisionat din cauza îngrijorărilor legate de siguranța acestei tehnologii.

Au urmat noi avertismente din partea cercetătorilor de la Anthropic și OpenAI, care au declanșat numeroase reacții pe rețelele sociale.

Hubinger a explicat ulterior care este principala sa îngrijorare. „Ceea ce mă îngrijorează este apariția superinteligenței prin autoîmbunătățire recursivă, despre care am spus deja că avansează mai repede decât ne așteptam”, a transmis acesta.

Ce înseamnă autoîmbunătățirea recursivă

Autoîmbunătățirea recursivă, cunoscută și sub acronimul RSI, apare atunci când inteligența artificială contribuie la perfecționarea procesului de creare a unor noi modele. Fenomenul ar putea determina o creștere accelerată a capacităților, pe măsură ce sisteme tot mai performante dezvoltă, la rândul lor, sisteme și mai avansate.

Principala temere este că, dacă inteligența artificială preia controlul asupra modului în care sunt antrenate noile modele, oamenii care au construit inițial aceste sisteme ar putea pierde controlul asupra lor.

Dezvoltarea AI avansează mai repede decât anticipau cercetătorii

Atât OpenAI, cât și Anthropic au avertizat în ultimele luni că această îmbunătățire autonomă a modelelor avansează mai rapid decât estimaseră.

„Datele noastre interne arată că Claude accelerează dezvoltarea inteligenței artificiale, ceea ce reprezintă o posibilă cale către autoîmbunătățirea recursivă sau către construirea autonomă de către AI a unui succesor mai performant”, a transmis Anthropic pe X, în luna iunie. „Acest proces se desfășoară mai repede decât credeam, iar implicațiile sale merită mai multă atenție”, a adăugat compania.

Deși inteligența artificială nu a ajuns încă la stadiul autoîmbunătățirii recursive, aceasta accelerează deja dezvoltarea sistemelor AI. Anthropic a precizat, într-un articol publicat în luna august, că inginerii săi produc, în medie, de opt ori mai mult cod într-un trimestru decât în perioada 2021-2025.

„Inteligența artificială a ajuns deja la nivelul la care poate genera idei noi”, a declarat Vincent Conitzer, profesor de informatică la Universitatea Carnegie Mellon. „Prin urmare, este foarte dificil de anticipat momentul în care acest proces ar putea începe să accelereze radical capacitățile AI.”

OpenAI avertizează asupra salturilor rapide de performanță

Sâmbătă, cercetătorul-șef al OpenAI, Jakub Pachocki, a afirmat că este îngrijorat de faptul că „nimeni nu este pregătit pentru consecințele unei creșteri rapide și continue a inteligenței artificiale”.

„Dacă dezvoltarea inteligenței artificiale continuă pe traiectoria actuală, sistemele pe care le vom vedea în următorii ani vor aduce probabil noi salturi de performanță, de aceeași amploare sau chiar mai mari, și vor contribui într-o măsură tot mai mare la propria lor dezvoltare”, a scris acesta într-un articol publicat pe blogul companiei.

În această săptămână, cercetători de la ambele companii au publicat numeroase avertismente despre autoîmbunătățirea recursivă, după demisia lui Jacob Coxon.

„Este greu de exagerat pericolul pe care îl presupune înaintarea rapidă către autoîmbunătățirea recursivă”, a afirmat miercuri seara Jasmine Wang, cercetătoare OpenAI specializată în alinierea sistemelor AI.

„Nu există încă un plan științific viabil pentru rezolvarea riscurilor generate de o inteligență artificială care se îmbunătățește recursiv. Vă rugăm să acordați atenție acestui pericol”, a transmis Anna Wang, care lucrează la Anthropic în domeniul siguranței și alinierii inteligenței artificiale generale.

Trei scenarii pentru viitorul inteligenței artificiale

Anthropic și-a încheiat analiza despre autoîmbunătățirea recursivă prezentând trei scenarii posibile.

În primul scenariu, progresul celor mai avansate modele încetinește, iar capacitățile AI sunt răspândite pe scară largă. Anthropic consideră însă că această variantă este puțin probabilă.

A doua posibilitate este ca laboratoarele de inteligență artificială să continue să obțină progrese, în timp ce oamenii păstrează controlul asupra dezvoltării sistemelor. Aceste schimbări ar transforma modul în care funcționează lumea. Iar Anthropic consideră că scenariul este „probabil”.

Un al treilea scenariu presupune ca sistemele AI să dobândească o capacitate completă de autoîmbunătățire recursivă, în timp ce oamenii ar ajunge să aibă un „rol considerabil diminuat în dezvoltarea lor”.

Modul în care va fi rezolvată sau nu „problema alinierii”, respectiv provocarea de a garanta că inteligența artificială urmărește obiective compatibile cu interesele oamenilor, rămâne aspectul asupra căruia compania spune că există cea mai mare incertitudine, potrivit CNBC.

0 comentarii