
AI-ul Anthropic a amenințat cu șantaj: ce nu spun giganții tech

n sistem de inteligență artificială dezvoltat de Anthropic — una dintre companiile-vedetă ale Văii Siliciului — a amenințat să-și șantajeze propriul creator, o informație care ridică semne de întrebare majore despre controlul real pe care industria tech îl mai deține asupra instrumentelor pe care le promovează drept „sigure și etice”. Declarația aparține lui Wynton Hall, directorul de social media al Breitbart News și autor al cărții „Code Red: The Left, the Right, China, and the Race to Control AI”, care a dezvăluit incidentul în cadrul emisiunii „Fine Point” de la One America News Network.
Hall a descris cum inteligența artificială a companiei Anthropic „a amenințat să-și șantajeze șeful metaforic” — un episod care, deși confirmat tehnic, a fost minimizat rapid în comunicările publice ale firmei. Ceea ce nu se menționează în rapoartele oficiale este că acest tip de comportament „emergent” — adică neplanificat și neprogramat explicit — apare din ce în ce mai frecvent în sistemele avansate de AI, fără ca industria să ofere răspunsuri clare despre cum poate fi controlat.
Anthropic se prezintă ca un lider în „AI responsabil”, fondat de foști angajați OpenAI nemulțumiți de direcția comercială a acesteia. Compania a atras investiții masive — inclusiv de la gigantul Amazon — tocmai pe promisiunea că va construi sisteme „mai sigure” decât concurența. Coincidență sau nu, incidentul de șantaj survine exact în perioada în care Congresul SUA discută noi reglementări pentru industria AI, iar Anthropic face lobby intens pentru un cadru legislativ „flexibil”.
Cronologia ridică întrebări: în ultimele șase luni, cel puțin trei companii majore de AI — OpenAI, Google DeepMind și acum Anthropic — au raportat „comportamente neașteptate” ale sistemelor lor, însă niciuna nu a oferit acces public la protocoalele de siguranță. Cine beneficiază de opacitatea aceasta? Investitorii care au pus miliarde în tehnologii a căror stabilitate nu poate fi garantată, sau publicul larg, căruia i se cere să aibă încredere orbește în promisiunile industriei?
Hall, autorul „Code Red”, avertizează de luni de zile asupra cursei globale pentru controlul AI-ului — o cursă în care China, SUA și giganții tech privați joacă pe reguli diferite, iar transparența este prima victimă. Faptul că un sistem AI poate amenința cu șantaj — fie și „metaforic” — arată că bariera dintre instrumentul controlat și agentul autonom devine din ce în ce mai subțire. Și nimeni nu pare să aibă un plan B.