Cursa pentru dezvoltarea inteligenței artificiale intră într-o nouă fază de alertă extremă. Dario Amodei, directorul general al start-up-ului californian Anthropic, a lansat un apel ferm către întreaga industrie și guverne pentru încetinirea dezvoltării modelelor avansate de IA, avertizând că agenți autonomi ar putea prelua controlul asupra internetului în doar câteva luni. Mesajul publicat sâmbătă de Dario Amodei vine la câteva zile după ce un cercetător de la Anthropic, Jacob Coxon, și-a anunțat plecarea din start-up-ul californian, acuzându-l că minimalizează riscul existențial pe care IA îl prezintă pentru umanitate si că „se joacă cu viețile noastre” pentru a obține supremația tehnologică, scrie Le Monde
Directorul general al Anthropic, Dario Amodei, a făcut apel sâmbătă, 12 septembrie, la temporizarea dezvoltării inteligenței artificiale (IA), invocând necesitatea unui control mai bun asupra evoluției acesteia și incidentul survenit în iulie la OpenAI. Trebuie „să temporizăm” îmbunătățirea IA „pentru ca prevenirea riscurilor să poată ține pasul”, a scris directorul general al Anthropic într-un mesaj publicat pe site-ul său personal.
Dario Amodei reia un alt apel, lansat la începutul lunii iunie de Anthropic, de a le oferi marilor jucători din domeniul IA posibilitatea de a „încetini sau suspenda temporar dezvoltarea” acestei tehnologii. La sfârșitul lunii iulie, Sam Altman, șeful rivalului OpenAI, vorbise la rândul său despre reducerea vitezei „pentru a oferi societății suficient timp să facă față acestor noi capacități”.
În continuare, peste o mie de angajați ai unor companii din fruntea domeniului IA, inclusiv Dario Amodei și lideri ai OpenAI, au cerut guvernului american să ajute la „temporizarea” lansării celor mai avansate modele. Aceste îndemnuri au avut loc după un incident în cadrul căruia modele ale OpenAI au ieșit spontan din mediul lor izolat în timpul unor teste, conectându-se la internet și atacând platforma de IA Hugging Face.
„Sute de miliarde de dolari în daune”
De atunci, alte câteva evenimente în care inteligențe artificiale de la OpenAI și Anthropic au accesat internetul fără știrea supraveghetorilor au fost raportate de cele două companii. De fiecare dată, acestea implicau agenți IA — adică un program specific construit pe un model, dotat cu propriile cunoștințe și obiective.
Acțiunile și metodele acestor agenți au îngrijorat cu atât mai mult cu cât au arătat o tendință de a se coordona, de a stabili o ierarhie între ei, de a trișa și de a șterge urmele acțiunilor lor. Având în vedere accelerarea actuală a dezvoltării IA, „mă tem că în șase până la doisprezece luni un grup [de agenți] va fi capabil să preia controlul asupra întregului internet”, avertizează Dario Amodei în mesajul său de sâmbătă, ceea ce „ar putea provoca daune de sute de miliarde de dolari”.
În comunicarea sa, Dario Amodei se arată îngrijorat de sosirea îmbunătățirii recursive autonome (RSI), un proces prin care IA se autoperfecționează fără intervenție umană. „Fără supraveghere, (această metodă) ar putea depăși capacitatea noastră de înțelegere și control asupra acestor sisteme”, explică șeful Anthropic. Aceasta trebuie aplicată „cu foarte multă prudență”, „dacă este deloc cazul să fie folosită”.
Pe lângă apelul său, Dario Amodei formulează mai multe propuneri, în primul rând integrarea unor observatori independenți de către liderii din domeniul IA. Deși o recomandă întregii industrii, liderul se angajează să o pună în aplicare mod unilateral la Anthropic. Observatorii vor avea același acces ca angajații companiei și vor putea verifica dacă start-up-ul își respectă angajamentele, vor putea raporta eventuale noi incidente și vor monitoriza încadrarea modelelor pentru a evita derapajele. Sâmbătă, Sam Altman a promis că va face același lucru la OpenAI.
Dario Amodei susține, de asemenea, colaborarea între cele mai avansate companii pentru a defini norme de securitate comune. El se declară favorabil și unei forme de coordonare politică între toate marile națiuni din domeniul IA.
„Dario are dreptate”, a reacționat câteva ore mai târziu Elon Musk pe X. „Sunt de acord cu Dario”, a scris și șeful OpenAI, Sam Altman, tot pe X. „Este unul dintre principalele subiecte de discuție la OpenAI în ultimele săptămâni.”
Dacă Elon Musk a avut frecvent comentarii pozitive despre Anthropic și abordarea sa privind IA, este foarte rar ca șeful OpenAI să susțină o inițiativă a celui de la Anthropic, cele două companii fiind marii rivali ai sectorului. De altfel, Dario Amodei a părăsit OpenAI în 2020 parțial pentru că considera că start-up-ul californian se arăta prea lax în privința securității IA, înainte de a fonda Anthropic în 2021.
„Se joacă cu viețile noastre”
Mesajul publicat sâmbătă de Dario Amodei vine la câteva zile după ce un cercetător de la Anthropic, Jacob Coxon, și-a anunțat plecarea din start-up-ul californian, acuzându-l că minimalizează riscul existențial pe care IA îl prezintă pentru umanitate.
Jacob Coxon plecase inițial de la OpenAI pentru a se alătura Anthropic, pe care o considera mai prudentă în cercetările sale. Miercuri, 9 septembrie, el a anunțat că părăsește industria, acuzând cele două laboratoare americane că „se joacă cu viețile noastre” în cursa lor pentru dezvoltarea unor IA capabile să se autoperfecționeze.
„Niciuna dintre cele două companii nu acționează în mod responsabil. Ele merg direct spre o superinteligență capabilă să se autoperfecționeze și se joacă cu viețile noastre”, a scris el marți pe contul său de X. „Oamenii care construiesc IA cred cu sinceritate că aceasta ne-ar putea ucide pe toți până la sfârșitul deceniului. Nu este o strategie de marketing”, a adăugat el.
Britanicul în vârstă de 27 de ani lucra de trei ani la preantrenare — etapa în care modelele de IA absorb cantități imense de date —, mai întâi la OpenAI, apoi anul acesta la marele rival Anthropic.
Un responsabil cu siguranța de la Anthropic, Evan Hubinger, i-a dat dreptate pe X: „Credem cu adevărat, cu sinceritate, că IA ar putea ucide toți oamenii”, a afirmat el, evaluând în nume personal acest risc la „peste 10%” în acest deceniu. M. Hubinger a adăugat că Anthropic face „tot ce poate”, dar „nu are încă un plan” pentru a se asigura că o IA care depășește capacitățile umane va asculta în continuare de creatorii ei, considerând totodată „scăzut” riscul reprezentat de modelele actuale.
El consideră sincere eforturile Anthropic, dar este de părere că nicio companie nu poate dezvolta în mod responsabil o IA care depășește oamenii fără intervenția statelor sau fără o încetinire coordonată. „La Anthropic, mizele sunt bine înțelese, dar sunt prinse într-o cursă pentru a ajunge primii: ei cred că nimeni altcineva nu va acționa responsabil și, prin urmare, trebuie să o facă ei înșiși, în ciuda riscului”, a scris el.
La începutul lunii august, guvernul american a stabilit un cadru de supraveghere ce prevede examinarea pe bază de voluntariat a noilor modele de IA înainte de lansare. Totuși, acest dispozitiv rămâne opac.
Mulți se întreabă cu privire la eficiența sa, în condițiile în care Donald Trump s-a declarat regulat împotriva oricărei măsuri care ar încetini dezvoltarea IA în Statele Unite, fie că este vorba despre lansarea modelelor sau despre construcția centrelor de date.
După ce au identificat derapajele modelelor lor, OpenAI și Anthropic au suspendat sau au încetinit fiecare lucrul la noile lor IA timp de câteva zile, înainte de a-l relua în același ritm.
We Must Pace the Frontier: I’ve written a new essay on why the AI industry should slow down, with a three-part plan for doing so.
— Dario Amodei (@DarioAmodei) September 12, 2026
Anthropic is unilaterally committing to the first of these steps. We’ll provide third-party evaluators with permanent, employee-level access to our…
Something clearly happened with a frontier AI model that hasn't been made public and it spooked them so much that it made Elon Musk, Dario Amodei, and Sam Altman all simultaneously agree to slow down. pic.twitter.com/86UEd4aunW
— Keith Edwards (@keithedwards) September 12, 2026



