Un coleg estimează că șansa ca AI să omoare toți oamenii într-un deceniu la peste 10%
Minge de cristal: Ce este mai îngrijorător decât perspectiva ca AI să aducă sfârșitul umanității? Oamenii care lucrează la aceste companii fac același avertisment. La câteva ore după ce un fost angajat OpenAI a părăsit Anthropic și a spus: „Nici o altă activitate umană nu prezintă acest nivel de pericol”, un coleg a spus că există o șansă de peste 10% ca inteligența artificială să omoare toți oamenii în următorul deceniu.
Jacob Coxon a anunțat ieri la X că și-a dat demisia de la Anthropic, după ce a petrecut ultimii trei ani făcând cercetări de pretraining atât la OpenAI, cât și la compania lui Dario Amodei. A fost membru al personalului tehnic al AI din iulie 2023 până când s-a mutat la Anthropic în iulie 2026.
„Niciuna dintre companii nu acționează în mod responsabil. Ei alergă direct către superinteligența auto-îmbunătățitoare și jocuri de noroc cu viețile noastre”, a scris el.
– Jacob Coxon (@hilbertspaess) 9 septembrie 2026
Coxon a făcut mai multe postări, dintre care niciuna nu va uşura mintea oricui deja îngrijorat de AI. El a avertizat că sistemele vor deveni în curând „supraomene” și vor putea să pirateze orice.
Există o mulțime de alte rânduri de rău augur în postările lui Coxon, cea mai îngrijorătoare fiind probabil: „Nici o altă activitate umană nu prezintă acest nivel de pericol”.
Cercetătorul a subliniat că atât OpenAI, cât și Anthropic sunt bine conștienți de aceste riscuri. „Oamenii care construiesc AI cred cu tărie că ne-ar putea ucide pe toți până la sfârșitul deceniului”, a spus el.
– Jacob Coxon (@hilbertspaess) 9 septembrie 2026
Deci, de ce companiile continuă să dezvolte aceste modele potențial cauzatoare de dispariții? Motivul, potrivit cercetătorului, este următorul: „La OpenAI, mulți nu au interiorizat profund mizele civilizaționale. La Anthropic, mizele sunt bine înțelese, dar sunt blocați într-o cursă pentru a ajunge primii – ei cred că nimeni altcineva nu va acționa responsabil, așa că trebuie să o facă singuri, în ciuda riscului.”
Coxon a spus că unii dezvoltatori de inteligență artificială cred că tehnologia ar putea cauza sfârșitul tuturor vieții umane în următorii câțiva ani, mai degrabă decât decenii, și că angajații seniori au fost cei mai preocupați de aceste posibilități.
Evan Hubinger, un lider în domeniul științei alinierii la Anthropic, i-a răspuns lui Coxon și nu a fost foarte liniștitor. El crede că ceea ce spune este „corect” și că Anthropic nu are niciun plan pentru ce să facă dacă se întâmplă.
„Jacob are dreptate aici – credem cu adevărat că AI ar putea ucide toți oamenii! Eu personal cred că este > 10% în următorul deceniu. Cred că Anthropic face tot posibilul, dar încă nu avem un plan pentru a rezolva alinierea pentru superinteligență și nu suntem în mod clar pe cale de a face acest lucru.”
– Evan Hubinger (@EvanHub) 9 septembrie 2026
Hubinger a spus că riscul de la modelele actuale este scăzut, dar el este îngrijorat de superinteligența care decurge din auto-îmbunătățirea recursivă. Anthropic a emis același avertisment în iunie.
Conceptul de AI care ucide pe toată lumea a trecut de la SF-ul la o realitate potențială în ultima vreme. Aceste temeri au fost exacerbate în urma mai multor incidente în care agenții AI au devenit necinstiți, inclusiv atacul Hugging Face, preluarea unui wiki german și o încercare de a înșela dezvoltatorii reali să aprobe coduri rău intenționate.
Există vreo soluție? Coxon crede că prevenirea unei catastrofe ar putea necesita o interdicție temporară a îmbunătățirii capabilităților modelului, dar este puțin probabil ca orice companie de AI să fie de acord cu această măsură.
