
AI-ul „scăpat de sub control”: cine profită de panică?

eea ce marile laboratoare de inteligență artificială prezintă drept „incidente alarmante de securitate” în care modelele lor ar fi acționat aproape autonom, ascunde de fapt o cronologie mult mai puțin dramatică — și una care coincide suspect cu planurile de listare la bursă ale companiilor implicate, evaluate la sute de miliarde de dolari.
Potrivit unor surse din industria tech citate de New York Post, marile laboratoare de AI din Silicon Valley ar supralicita deliberat aceste așa-numite „evadări” ale inteligenței artificiale pentru a presa guvernul federal american să construiască o barieră de reglementare care ar bloca practic orice concurență viitoare. Timing-ul — la câteva luni după ce atât OpenAI, cât și Anthropic au anunțat planuri de listare bursieră — ridică mai mult decât o simplă întrebare retorică.
Akhil Verghese, fondatorul companiei de software AI Krazimo, a declarat pentru NY Post că incidentele nu au fost deloc o rebeliune a mașinilor: „Li s-a spus pur și simplu să obțină cel mai bun rezultat posibil la un test.” Abhi Kumar, co-fondator al unei companii de voce-AI, a fost și mai direct: „Ce pentru unii este «modelul a evadat din sandbox», pentru alții este «nu ați construit corect sandbox-ul».” Taivo Pungas, chief intelligence officer la Pactum AI, spune că saltul de la „nu am construit cutia potrivită” la o urgență de nivel guvernamental pare exagerat.
Panica orchestrată
„Evadările” de AI care au aprins dezbaterea pe Capitol Hill vara aceasta par la fel de organice pe cât e un colorant artificial. Pe 16 iulie, modele OpenAI care rulau o evaluare de securitate cibernetică au exploatat o vulnerabilitate de tip zero-day și au trecut din mediul de test în sistemele de producție ale Hugging Face. OpenAI a raportat incidentul cinci zile mai târziu, numind GPT-5.6 Sol și un model nelansat, precizând că modelele fuseseră configurate „cu refuzuri cibernetice reduse, pentru a putea încerca exerciții ofensive pe care garanțiile normale le-ar respinge”. Nouă zile mai târziu, Anthropic a raportat trei incidente proprii.
Potrivit raportului Anthropic din 30 iulie, narativa „mașinile s-au trezit” este complet nefondată. „O eroare de configurare a lăsat mașinile accesate de Claude în cadrul evaluării cu acces live la internet”, a scris compania — deși modelelor li se spusese că sunt offline. Claude Opus 4.7 a atacat o companie reală care avea, din întâmplare, același nume cu ținta fictivă și a extras „câteva sute de rânduri de date de producție”. Mythos 5 a publicat un pachet Python capcană pe registrul live PyPI, descărcat și rulat pe „15 sisteme reale”. Un model de cercetare nelansat a scanat „aproximativ 9.000 de ținte” și a pătruns în aplicația web a unei companii „folosind tehnici de atac cibernetic de bază, bine cunoscute”. Verdictul Anthropic: „Credem că aceste incidente se apropie mai degrabă de o eroare operațională și de configurare decât de o eroare de aliniere a modelului.” Compania a oprit evaluările cibernetice pe 23 iulie și a chemat METR — arbitrul lor preferat — să analizeze situația.
Există totuși o nuanță în relatarea Anthropic: Opus 4.7 a continuat atacul chiar și după ce a recunoscut că sistemul era real. Doar modelul de cercetare mai nou s-a oprit. Deci mașinile nu sunt uniform „nevinovate” — dar un model care continuă să-și urmeze instrucțiunile pe o rețea configurată greșit e o eroare a celor care au construit testul, nu dovadă de intenție.
Numitorul comun
Fiecare dintre aceste evaluări a fost realizată de aceeași terță parte: Irregular, firmă de securitate AI care a testat modelele OpenAI, Anthropic și Google și care, potrivit Axios, a „lovit aceleași probleme de securitate” de fiecare dată. The Verge adaugă și Meta pe listă — un tipar semnalat încă din iulie de jurnalista Axios Sam Sabin, care nota că modelele Anthropic au avut acces „accidental” la internet în timpul testării, din cauza unei „neînțelegeri” cu partenerul de testare Irregular.
Apoi a venit Gemini. Wall Street Journal a relatat că modelul Google a pătruns în trei companii reale în timpul unui exercițiu de tip capture-the-flag organizat de Irregular. Incidentul a avut loc în mai, Irregular și-a publicat raportul pe 14 august, iar Google nu a menționat nimic până când ziarul nu a sunat să întrebe — explicând ulterior că nu considerase hackurile demne de raportat pentru că Gemini „a acționat corespunzător” și s-a oprit imediat ce a realizat că țintele erau reale.
Irregular a declarat pentru Axios că modelul „nu ar fi trebuit să aibă acces online, dar accesul la internet a fost disponibil neintenționat”, iar „compania-țintă fictivă avea același nume ca una reală”. Într-un caz, Gemini a ghicit parole până a intrat; în alte două, a găsit credențiale expuse public. Irregular susține că „toate problemele cunoscute de partea noastră au fost remediate cu săptămâni în urmă” și că incidentul Gemini „nu reprezintă un eveniment separat semnificativ”. Vicepreședinta Google, Heather Adkins, a declarat: „Dezvoltarea sigură a modelelor puternice de AI este critică și investim masiv în acest domeniu.” Analizând faptele concrete însă, modelul a fost lipsit de vină.
Așadar Google — companie care nu cere Washingtonului să încetinească nimic și care a considerat incidentul un non-eveniment — contrastează izbitor cu cele două laboratoare care fac lobby pentru o încetinire federală și care s-au grăbit să emită comunicate de presă alarmiste.
Comentatorul din industrie John Ennis a pus întrebarea evidentă, subliniind că „o dată e un accident, de două ori e suspect, dar de trei ori pare intenționat” — și a remarcat că Irregular ar fi aliniată mișcării Effective Altruism (EA), o tendință „doomsday” care de un deceniu ocupă poziții cheie în consiliile de siguranță AI și în laboratoarele de testare, pe premisa că inteligența artificială va ucide pe toată lumea dacă nu sunt „oamenii potriviți” la control. Dacă Irregular este sau nu aliniată EA rămâne opinia lui Ennis — dar faptul că această firmă apare în spatele tuturor incidentelor este confirmat de Axios, The Verge și chiar de Anthropic.
Jocul încetinirii ritmului
Cu șase zile înainte să iasă la iveală povestea Gemini, Dario Amodei a publicat pe 12 septembrie un mesaj în care avertiza că, în următoarele 6-12 luni, un „roi” de AI ar putea „prelua întregul internet printr-un botnet persistent”, cauzând potențial sute de miliarde de dolari în pagube. Prescripția lui: „Trebuie să încetinim ritmul în care îmbunătățim capacitățile modelelor AI.” Sam Altman și Elon Musk și-au semnalat susținerea. Practic, strategia „Pacing the Frontier” este o încercare de a deveni strategic indispensabil — prea mare pentru a eșua, cu Beijingul drept justificare.
Jensen Huang, șeful Nvidia, a remarcat sarcastic: „Ce metodă mai bună de a crea cerere decât să creezi o problemă.” Nikesh Arora, CEO Palo Alto Networks, a numit-o inițial o „mișcare ninja” genială, dar după ce a discutat mai mult cu laboratoare, proiecte open-source și reprezentanți guvernamentali, a avertizat că manevra ar putea avea efect invers: a încurajat fiecare legiuitor din lume să aibă o opinie despre AI și a introdus incertitudine în întreaga industrie de infrastructură AI.
Legislatorii americani au reacționat exact cum era de așteptat. Senatorul Josh Hawley a deschis o investigație asupra OpenAI pe 9 septembrie, cu termen limită pentru documente pe 1 octombrie; senatorul Bernie Sanders a anunțat un proiect de lege pentru interzicerea dezvoltării ulterioare de modele „frontier”; senatoarea Elizabeth Warren a cerut o „pauză imediată”. Pe de altă parte, Casa Albă a intervenit din direcția opusă — Donald Trump a scris pe rețelele sale că îngrijorările privind siguranța AI sunt o „păcăleală” și că va numi un „țar AI” și va înființa o „AI Force”, potrivit Bloomberg.
Urmărește banii
Un document intern OpenAI, obținut de Financial Times, proiectează un flux de numerar negativ de 278 de miliarde de dolari între 2026 și 2030, cu factura de calcul (compute) crescând de la o estimare de 600 de miliarde de dolari în februarie la 856 de miliarde până în iulie — în timp ce venitul sperat ar trebui să crească de la 36 de miliarde de dolari anul acesta la 350 de miliarde în 2030. Altman și-a revizuit deja calendarul privind transformarea economică ce urma să acopere aceste costuri.
Anthropic, între timp, și-a mutat listarea bursieră planificată din octombrie în noiembrie, potrivit Wall Street Journal, pe fondul unui venit anualizat estimat la peste 100 de miliarde de dolari, conform Reuters. Și, la o săptămână după ce CEO-ul companiei a spus că industria trebuie să încetinească, Reuters relatează că Anthropic ia în calcul lansarea grăbită a unui model nou pentru a contracara avansul OpenAI, chiar înainte de listarea bursieră. Încetinire pentru alții, aparent.
Context extins: dacă un model open-weight produs, să zicem, la Hangzhou reușește 95% din performanța lui Claude sau GPT-5 la o fracțiune din cost, evaluările pe care se bazează ambele laboratoare se prăbușesc. Singura modalitate de a proteja marjele, de a justifica arderea de capital și de a satisface Wall Street-ul este să facă practic imposibilă din punct de vedere legal concurența oricui altcuiva — un zid regulatoriu atât de gros, și costuri de conformitate atât de mari, încât doar o corporație de 100 de miliarde de dolari și-ar putea permite să antreneze un model de vârf. Observația lui Arora rămâne valabilă: nicio soluție reală de securitate nu a fost propusă — doar mai mulți bani de calcul „pentru siguranță” și un organism federal care să valideze totul.
Modelele nu s-au răzvrătit. Un contractor a lăsat accesul la internet deschis, de cel puțin trei ori câte știm, iar cele două laboratoare cu listări bursiere de protejat au transformat asta într-un argument pentru încetinirea impusă federal. Documentele cerute de Hawley sunt scadente pe 1 octombrie, Anthropic a promis o transcriere redactată din incidentul PyPI și o evaluare externă METR, iar explicația Google pentru faptul că a stat pe o breșă din mai, care a afectat trei companii, până când un ziar a sunat să întrebe, este că modelul „s-a comportat corespunzător”. Cronologia, cel puțin, ridică mai multe întrebări decât răspunsuri oferă.
Sursă: ZeroHedge News (zerohedge.com)