3 Minute
Imaginează-ți un AI cu trilioane de parametri care rulează nu pe GPU-uri occidentale, ci pe hardware produs în China. Pare o rescriere a tehnologiei, și exact asta încearcă DeepSeek cu modelul său de generație următoare.
Surse sugerează că DeepSeek V4 va rula exclusiv pe cele mai noi cipuri Ascend de la Huawei. Nu este o schimbare minoră. Reflectă un efort mai amplu de a conecta modelele avansate la siliciul intern, pe măsură ce controalele la export îngreunează accesul dezvoltatorilor chinezi la cipurile H de la Nvidia.
De ce această schimbare? Parțial pentru că scara impune acum o coordonare strânsă între arhitectura modelului și cipul care îl va rula. DeepSeek intenționează să implementeze aproximativ un trilion de parametri, iar startup-ul ar urma să folosească sute de mii de procesoare Ascend 950PR pentru a atinge vitezele și capacitatea dorite de inferență. Obiectivul: o inferență de aproximativ 1,8x mai rapidă, o fereastră de context apropiindu-se de un milion de tokeni și câștiguri de eficiență determinate de optimizări de tip Engram.

Ultimul detaliu contează. Tehnicile Engram reconfigurează modul în care modelele stochează și recuperează informația, reducând suprasarcina de memorie fără a compromite profunzimea raționamentului. Pentru un model de dimensiunea V4, astfel de trucuri fac diferența între fezabil și fantezie. Se spune că DeepSeek a petrecut luni rescriind codul de bază și testând performanța pe banc de lucru împreună cu ingineri de la Huawei și Cambricon pentru a stoarce performanță din noul stack.
Alte giganturi tehnologice chineze pariază similar. Alibaba, ByteDance și Tencent au comandat cantități semnificative de siliciu Ascend 950PR, semnalând că ecosistemele de cipuri interne devin rapid platforma implicită pentru proiecte majore de AI în China. În acest sens, mutarea DeepSeek este atât strategică, cât și practică.
Există și un unghi legat de calendar. Cipurile H20 de la Nvidia au intrat sub o supraveghere mai strictă a exporturilor, împingând startup-urile și furnizorii cloud să accelereze migrarea către acceleratoare produse local. DeepSeek mai folosea deja variante Ascend în modelele anterioare, astfel că migrarea completă către o infrastructură centrată pe Huawei este o continuare a lucrului existent, nu un salt brusc.
Din punct de vedere funcțional, se spune că V4 pune accent pe capacități avansate de programare și pe un raționament îmbunătățit în mai mulți pași. Pe românește: mai bun la scrierea de programe complexe, mai apt să susțină conversații lungi și mai eficient în a lega logica pe porțiuni vaste de text. Două variante V4 suplimentare, adaptate altor cipuri fabricate în China, ar fi în curs de dezvoltare și ar putea apărea înainte de sfârșitul anului.
Concluzia mai amplă este aceasta: cursa pentru AI se fragmentează în ecosisteme hardware, fiecare optimizat pentru propriul set de compilatoare, runtime-uri și trucuri de optimizare. Pentru startup-uri precum DeepSeek, drumul către performanță de vârf poate trece acum prin siliciul intern la fel de mult ca prin inovația algoritmică.
Cât va da roade această abordare va depinde de cât de bine echipele software pot transforma cipurile brute în servicii utilizabile și fiabile și de cât de repede continuă să se schimbe peisajul global al hardware-ului pentru AI.















Lasă un comentariu
Comentarii
Niciun comentariu încă. Fii primul.