Revolta tokenilor: giganții tech cer scădere de 90% a prețurilor AI
economie libera

Revolta tokenilor: giganții tech cer scădere de 90% a prețurilor AI

C
5 min de citit

eea ce oficial este prezentat drept o simplă dezbatere despre prețuri în industria inteligenței artificiale ascunde, de fapt, o fractură structurală profundă: modelul economic pe care companiile de AI l-au construit cu sute de miliarde de dolari investiți ar putea fi, în esență, de nesuportat pentru clienții pe care încearcă să-i cucerească.

90% sau nimic

Nikesh Arora, directorul executiv al Palo Alto Networks — una dintre cele mai mari companii de securitate cibernetică din lume, care cumpără servicii AI la scară industrială — a declarat pentru CNBC că prețurile per token trebuie să scadă cu până la 90% înainte ca adoptarea la scară largă în mediul enterprise să devină posibilă. Concret, Arora vrea costuri la aproximativ o cincime din nivelul actual în 12 luni și o reducere de 90% în doi ani. Nu e o cerere venită de la un utilizator marginal — e un semnal de alarmă tras de cineva care plătește factura la scară.

Cu opt zile înainte, Alex Karp de la Palantir izbucnise la televizor, descriind drept „complet nebunesc” modelul economic al închirierii inteligenței artificiale pe token. Acum, tonul e mai calm, dar numărul e la fel de brutal. Cronologia ridică semne de întrebare: de ce tocmai acum, în același interval de câteva zile, mai mulți directori executivi de top din industrie atacă simultan același punct vulnerabil al furnizorilor de AI?

Sam Altman clipește primul

Nu este o coincidență că declarațiile lui Arora au apărut exact în ziua în care OpenAI a lansat familia GPT-5.6, cu Sam Altman anunțând pe CNBC că noul model este cu 54% mai eficient pe sarcini de codare agentică. Arora a primit anunțul cu o aprobare minimă: „Cred că 54% e un bun început. Cred că mai avem nevoie de o rundă.” Traducerea liberă: bine, acum fă-o din nou. De două ori.

Ceea ce nu se menționează în comunicatele oficiale este că această „eficiență” vine după luni în care clienții enterprise au țipat la OpenAI că facturile sunt de nesuportat. Altman însuși a recunoscut în iunie că prețul a trecut de la un neajuns minor la o problemă majoră pentru clienți. O lună mai târziu, „tăierile drastice” promis anunțate apar mascate ca îmbunătățiri tehnice.

Meta intră în ring cu prețuri de dumping

Tot în aceeași perioadă, Meta a lansat Muse Spark 1.1, primul său produs serios pe piața de codare agentică — la prețuri de 1,25 dolari per milion de tokeni de intrare și 4,25 dolari per milion de tokeni de ieșire, poziționat direct alături de tierele bugetare ale rivalilor Anthropic și OpenAI. Alexandr Wang, șeful Meta AI, a descris prețurile drept „foarte agresive și atractive”.

Cine beneficiază? Răspunsul e mai complicat decât pare. Mark Zuckerberg a rupt o tăcere de trei ani pe X pentru a promova Spark ca un model „la un preț foarte mic” — directorul executiv al unei companii care cheltuiește peste 100 de miliarde de dolari pe an pe infrastructură AI, sub presiunea acționarilor să demonstreze că investițiile se întorc. Că un CEO în această poziție alege să se laude cu ieftinătatea produsului său spune mai mult decât orice raport anual.

Matematica nu s-a schimbat

În spatele acestor declarații stă o ecuație imposibilă pe care industria încearcă să o ascundă. Uber și-a epuizat bugetul pentru codare agentică în patru luni și a impus limite de utilizare. O companie a primit prima factură AI și conducerea a răspuns simplu: „Nu avem banii pentru asta.” UBS estimează că prețurile tokenilor reprezintă acum o problemă reală pentru aproximativ 60% dintre clienții enterprise.

JPMorgan a avertizat că scăderea prețurilor nu rezolvă automat problema clientului, dar distruge cu certitudine modelul de afaceri al furnizorului. Analiza Gartner sugerează că chiar și o prăbușire de 90% a costurilor de inferență s-ar putea să nu reducă facturile enterprise, deoarece consumul agentică crește mai repede decât scad prețurile. Apollo a identificat problema în oglindă: dacă prețurile tokenilor converg spre zero, nu există suficient venit pentru a susține infrastructura hyperscaler, chiar și într-o lume în care cererea de procesare continuă să crească.

Arora’s 90% este numărul de supraviețuire al clientului. Poate fi și numărul de extincție al furnizorului.

Pariurile continuă, indiferent de răspuns

Între timp, infrastructura nu stă să aștepte rezolvarea acestei contradicții. Amazon a ridicat 25 de miliarde de dolari în datorii pentru infrastructură AI. SpaceX a vândut obligațiuni de 25 de miliarde de dolari luna trecută. SK Hynix a realizat cea mai mare listare americană din istoria unei companii străine — 26,5 miliarde de dolari, cu ADR-urile deschizând cu 14% peste prețul de ofertă. Companiile care vând lopeți înregistrează capitalizări record în același moment în care companiile care vând tokeni sunt somați să taie prețurile cu 90%.

Contextul mai larg, pe care analiza financiară mainstream îl trece cu vederea: această presiune pe prețuri coincide cu momentul în care modelele chineze — Qwen, DeepSeek și altele — au capturat, în anumite perioade, peste 60% din consumul global de tokeni în rândul modelelor de top. Coinbase și-a redus cheltuielile interne cu AI aproape la jumătate prin trecerea la modele open-weight chineze. Microsoft analizează o variantă găzduită de DeepSeek pentru propriile instrumente agentice. Cine beneficiază de un război al prețurilor care împinge clienții enterprise spre alternative mai ieftine? Răspunsul nu e neapărat cel pe care industria americană de AI l-ar prefera.

OpenAI și-a amânat deja IPO-ul pentru 2027. Anthropic, cu un ARR anunțat de 47 de miliarde de dolari — cifră privită cu scepticism de analiști chiar la momentul în care era promovată înaintea dosarului de IPO — trebuie acum să demonstreze că acele venituri rezistă într-o lume în care clienții și-au citit facturile și Meta oferă tokeni la 1,25 dolari per milion.

Sursă: ZeroHedge News (zerohedge.com)

Acest articol a fost creat cu asistența inteligenței artificiale și verificat editorial de Redactia.