DeepSeek scutură Coreea: cine pierde din memoria AI ieftină
economie libera

DeepSeek scutură Coreea: cine pierde din memoria AI ieftină

10 min de citit

n timp ce presa mainstream vorbește despre „inovație chineză” și „competiție sănătoasă” în AI, un fapt tehnic aparent obscur — reducerea consumului de memorie a unui model DeepSeek — a șters miliarde de dolari din capitalizarea giganților coreeni ai memoriei. Cine beneficiază de fapt de acest anunț și de ce vine chiar acum, în plin proces de listare a DeepSeek la bursă?

Samsung Electronics și SK Hynix au scăzut fiecare cu peste 3% la Seul, după ce DeepSeek a anunțat că noul său model AI are nevoie de o fracțiune din memoria consumată de predecesorul său. Ambele acțiuni încercau deja să se refacă după căderea din iulie și rămân cu peste 25% sub maximele istorice. Traderii de retail din Coreea de Sud, cei care au alimentat rally-ul de la începutul anului, au vândut acțiuni de aproximativ 10 miliarde de dolari doar în luna curentă.

Ce a lansat DeepSeek — și de ce titlul lucrării spune totul

Declanșatorul a venit din Hangzhou. Noul model, V4.1-Flash, este rapid, ieftin și, conform cifrelor companiei, mai puternic decât modelul-far anterior. Dar titlul lucrării publicate de DeepSeek nu are nicio legătură cu benchmark-uri de inteligență — se numește „Împingerea limitelor compresiei cache-ului KV”, iar rezumatul identifică explicit consumul de memorie în timpul sesiunilor AI lungi drept principalul obstacol în reducerea costurilor de operare.

V4.1-Flash este un model cu 552 de miliarde de parametri, dar DeepSeek nu îi activează pe toți simultan: folosește 8 miliarde de parametri la procesarea datelor de intrare și 16 miliarde la generarea rezultatelor — un design care scade drastic puterea de calcul necesară la fiecare pas. Modelul poate gestiona o fereastră de context de un milion de token-uri, citește nativ imagini, iar ponderile sale sunt disponibile sub licență MIT, ceea ce înseamnă că oricine cu suficient hardware îl poate rula. Nu întâmplător, nouă furnizori îl ofereau deja prin OpenRouter la mai puțin de 24 de ore de la lansare.

Problema tehnică din spate merită explicată, pentru că ea explică panica bursieră. Pe măsură ce un model AI parcurge un document, o conversație sau o sarcină lungă, păstrează o evidență a ceea ce a procesat deja — numită cache KV — pentru a nu recalcula totul de la zero. Acest cache este stocat de obicei în memorie de mare bandă (HBM), tehnologie extrem de scumpă și rapidă, cea care a transformat SK Hynix, Samsung și Micron în unele dintre cele mai vânate acțiuni din 2026 pe fondul cererii explozive de AI. Problema: cu cât sesiunea AI e mai lungă, cu atât cache-ul crește, ajungând uneori să depășească memoria ocupată de modelul propriu-zis.

DeepSeek spune că a rezolvat exact această problemă, printr-o arhitectură care reutilizează informația cache între straturile rețelei, o stochează la precizie de 4 biți și reconstruiește doar părțile necesare, nu întregul istoric. Rezultatul: 890 de bytes de cache per token, un sfert din ce reținea în HBM modelul Flash anterior și o optime din ce scria pe SSD.

Memorie pe token, redusă de 437 de ori — cine plătește diferența?

Cifra cea mai relevantă pentru Seul urmărește cât de multă memorie cache e necesară per token, de-a lungul generațiilor succesive de modele DeepSeek. De la primul lansat în ianuarie 2024 până la V4.1-Flash, această cifră a scăzut de 437 de ori. Declinul nu a început acum: modelul V4 din aprilie tăiase deja necesarul de cache KV la o zecime față de predecesor, la fereastra completă de context, iar cel din septembrie l-a redus cu încă trei sferturi.

Pe partea cealaltă a acestei ecuații stau exact premisele de creștere pe care s-a construit tot trade-ul memoriei. Micron spune că întreaga sa producție de HBM pentru 2026 este deja contractată, atât la preț cât și la volum. În decembrie, compania estima o piață HBM care ar putea crește de la circa 35 de miliarde de dolari în 2025 la aproximativ 100 de miliarde în 2028; până în iunie, aceeași estimare de 100 de miliarde fusese mutată deja pentru 2027. Micron raportează rezultatele pe 30 septembrie și a ghidat trimestrul la aproximativ 50 de miliarde de dolari venituri — cu 350% peste anul precedent — și marjă brută de 86%. Cât de multă memorie premium consumă fiecare unitate de muncă AI este exact miza din spatele acestor cifre.

Vechiul model, retras discret

Începând cu 14 septembrie, DeepSeek va direcționa fiecare cerere destinată modelului-far V4-Pro (1,6 trilioane de parametri) către V4.1-Flash, la tariful mai mic al Flash, până la apariția unui V4.1-Pro — pentru care nu există deocamdată dată de lansare. Compania susține că modelul mai mic depășește deja V4-Pro la performanță, cost, viteză și timp de execuție a sarcinilor. Cronologia ridică o întrebare simplă: de ce să retragi discret modelul tău flagship exact quando ești în plin proces de pregătire pentru listarea la bursă din Shanghai?

Comparativ cu modelele americane de vârf, V4.1-Flash urmează un tipar deja familiar din acest an. Pe propriile tabele de benchmark ale DeepSeek, modelul depășește la limită cele mai bune scoruri raportate de Claude Opus 5 sau GPT-5.6 Sol pe teste precum Terminal-Bench 2.1, DeepSWE, CyberGym și Humanity’s Last Exam, atunci când sunt permise unelte externe. Pe teste mai noi și mai dificile, însă, frontiera americană rămâne clar în avans — V4.1-Flash obține 30,0 față de 43,3 al lui Opus pe Terminal-Bench 3.0, 31,2 față de 51,8 pe versiunea 4.0, 20,3 față de 37,0 pe ProgramBench și 15,3 față de 33,7 pe ExploitGym. Rezultatele nu au fost verificate independent.

86 de ori mai ieftin? Cifrele din spatele titlului viral

Potrivit unui utilizator X cunoscut sub numele NIK, V4.1-Flash ar fi de 86 de ori mai ieftin decât modelele-far americane — o cifră care a circulat rapid pe rețele, deși provine din calculul propriu al postării, nu dintr-o sursă oficială independentă. La ore de vârf, V4.1-Flash costă 0,30 dolari per milion de token-uri de intrare și 1,20 dolari per milion de token-uri de ieșire, cu prețuri înjumătățite în afara orelor de vârf. Anthropic percepe 5 și, respectiv, 25 de dolari pentru Claude Opus 5 — ceea ce face DeepSeek de aproximativ 20 de ori mai ieftin la vârf și circa 40 de ori mai ieftin în afara vârfului, la nivelul token-urilor de ieșire. Diferența de 86 de ori vine, de fapt, din costul token-urilor de intrare stocate în cache: Anthropic percepe 50 de cenți per milion de token-uri cache, DeepSeek doar șase zecimi de cent — exact costul pe care noua arhitectură de memorie a fost construită să-l reducă.

Ce nu se menționează suficient în relatările despre „prețuri de dumping”: DeepSeek și-a majorat propriile tarife cu doar o lună în urmă. Pe 16 august, compania a mutat V4-Flash de la tarife fixe de 0,14 dolari (intrare) și 0,28 dolari (ieșire) la tarife de vârf de 0,44 și 1,32 dolari. Lansarea de joi a adus prețurile înapoi în jos, deși nu la nivelul din iulie, oferind în același timp clienților V4-Pro o reducere de aproximativ 70%.

Sincronizare suspectă: listarea la bursă

Anunțul tehnic vine chiar în perioada în care DeepSeek se pregătește să intre pe piețele publice. Compania a angajat CITIC Securities pentru pregătirea unei listări la Shanghai, după o rundă de finanțare din iunie de aproximativ 7,4 miliarde de dolari, cu investitori precum Tencent și CATL, plus zvonuri despre o nouă rundă la o evaluare apropiată de 500 de miliarde de yuani. Coincidență sau strategie de marketing calculată înainte de IPO? Cronologia — anunț tehnic spectaculos, apoi retragerea vechiului model-far, apoi pregătiri de listare — ridică cel puțin o întrebare despre ordinea reală a priorităților.

Iulie a fost despre ofertă, septembrie e despre cerere

Vânzarea masivă din iulie a acțiunilor coreene de memorie s-a concentrat pe ofertă: SK Hynix anunțase o creștere majoră a cheltuielilor, iar producătorii chinezi de memorie continuau să inunde piața cu producție mai ieftină. Panica de acum vine din partea opusă a ecuației: fiecare unitate de activitate AI are nevoie de tot mai puține cipuri de memorie.

Micron și SanDisk, care rezistaseră peste noapte, urcau deja în tranzacționarea pre-piață de vineri, după rezultatele cloud ale Oracle. Acțiunile coreene, unde gradul de îndatorare și participarea investitorilor de retail sunt mai mari, au încasat lovitura imediată. Mișcări de 5% sau mai mult într-o singură zi rămân comune pentru Samsung și SK Hynix — Bloomberg notează că volatilitatea rămâne la niveluri nemaivăzute din criza financiară din 2008 și șocul Covid. Totuși, acțiunile arată ieftin după măsurile convenționale: Samsung tranzacționează la circa 2,7 ori valoarea contabilă, iar Hynix la 5 ori, comparativ cu aproximativ 11 ori pentru indicele semiconductorilor din Philadelphia.

În câteva ore, Jung In Yun de la Fibonacci Asset Management a sugerat că un AI mai ieftin ar putea stimula utilizarea și compensa câștigurile de eficiență, în timp ce Ha SeokKeun de la Eugene Asset Management a numit problema o îngrijorare pe termen scurt. Scenariul amintește exact de ce s-a întâmplat acum aproape doi ani: când Seulul s-a redeschis după Anul Nou Lunar, la unsprezece zile după lansarea modelului R1 al DeepSeek, SK Hynix a căzut cu până la 12% într-o zi, iar Samsung cu 4%. Investitorii se temeau atunci că modelele mai eficiente vor slăbi cererea de hardware AI. În schimb, cheltuielile pentru AI au continuat să crească — argumentul că prețurile mai mici stimulează utilizarea mai mare a câștigat anul care a urmat.

Controale la export și cartea ascunsă a Huawei

Ce nu apare suficient de clar în relatările despre „inovația” DeepSeek: din decembrie 2024, controalele americane la export interzic vânzarea de memorie HBM avansată către China, transformând accesul la memorie rapidă într-una dintre principalele constrângeri hardware pentru dezvoltatorii chinezi de AI. Huawei lucrează la o alternativă internă — cipul Ascend 950DT folosește memorie proprie HiZQ 2.0, cu 144 gigabytes capacitate și 4 terabytes/secundă bandwidth, rămânând totuși mult în urma memoriei HBM pe care SK Hynix o furnizează pentru acceleratoarele Nvidia de top.

V4 al DeepSeek, lansat în aprilie, a fost primul model de vârf validat atât pe hardware Huawei Ascend, cât și pe Nvidia. Compania are, de asemenea, o comandă raportată pentru 160.000 de procesoare Ascend 950DT, destinate unui centru de date de scară gigawatt în Ulanqab. Cine beneficiază de fapt dintr-un model care are nevoie de un sfert din memoria per token? Un astfel de model poate fi rulat mai ușor exact pe hardware-ul care are mai puțină memorie de oferit — adică pe cipurile chinezești, ocolind restricțiile occidentale la export. Fișa tehnică a modelului V4.1-Flash nu precizează pe ce hardware a fost antrenat efectiv.

DeepSeek nu a anunțat încă o dată de lansare pentru versiunea mai mare din familia V4.1. Micron raportează rezultatele pe 30 septembrie — o dată de urmărit pentru oricine vrea să vadă dacă piața de memorie confirmă sau infirmă temerile stârnite la Seul.

Sursă: ZeroHedge News (zerohedge.com)

Acest articol a fost creat cu asistența inteligenței artificiale și verificat editorial de Redactia.