Straipsnis

DeepSeek V4 ir Huawei lustai: naujas Kinijos DI posūkis

DeepSeek V4 gali veikti tik su Huawei Ascend lustais, rodydamas Kinijos DI rinkos posūkį į vietinę aparatinę įrangą, spartesnį išvedimą ir trilijono parametrų modelius.

DeepSeek V4 ir Huawei lustai: naujas Kinijos DI posūkis
Skaitymo laikas: 3 Minutės

Įsivaizduokite trilijono parametrų DI modelį, veikiantį ne Vakarų GPU, o Kinijoje pagamintoje aparatinėje įrangoje. Tai skamba kaip technologijų scenarijaus perrašymas, ir būtent to DeepSeek siekia su savo naujos kartos modeliu.

Pranešama, kad DeepSeek V4 veiks išskirtinai su naujausiais Huawei Ascend lustais. Tai nėra nedidelis krypties pakeitimas. Šis žingsnis atspindi platesnį siekį susieti pažangius dirbtinio intelekto modelius su vietiniais puslaidininkiais, nes eksporto kontrolė Kinijos kūrėjams vis labiau apsunkina prieigą prie Nvidia H serijos lustų.

Kodėl vyksta šis pokytis? Iš dalies todėl, kad mastelis dabar reikalauja itin glaudaus modelio architektūros ir ją aptarnaujančio lusto suderinimo. DeepSeek siekia įdiegti maždaug trilijono parametrų modelį, o startuolis, kaip tikimasi, pasitelks šimtus tūkstančių Ascend 950PR procesorių, kad pasiektų numatytą išvedimo spartą ir pajėgumą. Tikslas: apie 1,8 karto spartesnis išvedimas, konteksto langas, priartėjantis prie vieno milijono žetonų, ir efektyvumo augimas, kurį užtikrintų Engram tipo optimizacijos.

Pastaroji detalė yra svarbi. Engram metodai perkuria tai, kaip modeliai saugo ir atkuria informaciją, sumažindami atminties sąnaudas, bet išlaikydami samprotavimo gylį. Tokio dydžio modeliui kaip V4 tokie sprendimai lemia skirtumą tarp realiai įgyvendinamo projekto ir fantazijos. Pranešama, kad DeepSeek kelis mėnesius perrašinėjo pagrindinį kodą ir kartu su Huawei bei Cambricon inžinieriais atliko našumo bandymus, siekdama išspausti kuo daugiau galios iš naujosios technologinės bazės.

Panašius statymus atlieka ir kiti Kinijos technologijų milžinai. Alibaba, ByteDance ir Tencent pateikė didelius Ascend 950PR lustų užsakymus, o tai rodo, kad vietinės lustų ekosistemos sparčiai tampa numatytąja platforma dideliems DI projektams Kinijoje. Šia prasme DeepSeek žingsnis yra ir strateginis, ir praktiškas.

Čia svarbus ir laiko veiksnys. Nvidia H20 lustai susiduria su griežtesne eksporto priežiūra, todėl startuoliai ir debesijos paslaugų teikėjai yra skatinami spartinti perėjimą prie vietoje gaminamų DI spartintuvų. DeepSeek ankstesniuose modeliuose jau naudojo Ascend variantus, todėl visiškas perėjimas prie Huawei pagrindu sukurtos infrastruktūros yra esamo darbo tąsa, o ne staigus šuolis.

Funkciniu požiūriu teigiama, kad V4 daugiausia dėmesio skirs pažangioms programavimo galimybėms ir geresniam kelių žingsnių samprotavimui. Paprastai tariant: modelis turėtų geriau rašyti sudėtingas programas, geriau palaikyti ilgas pokalbių sekas ir tiksliau sujungti loginius ryšius labai dideliuose tekstų masyvuose. Pranešama, kad kuriami dar du V4 variantai, pritaikyti kitiems Kinijoje gaminamiems lustams, ir jie gali pasirodyti iki metų pabaigos.

Čia matyti platesnė išvada. DI lenktynės skyla į aparatinės įrangos ekosistemas, kurių kiekviena derinama prie savo kompiliatorių, vykdymo aplinkų ir optimizavimo metodų. Tokiems startuoliams kaip DeepSeek kelias į aukščiausio lygio našumą dabar gali eiti ne tik per algoritmines inovacijas, bet ir per vietinius puslaidininkius.

Ar šis metodas pasiteisins, priklausys nuo to, kaip gerai programinės įrangos komandos sugebės neapdorotą lustų galią paversti naudojamomis ir patikimomis paslaugomis, taip pat nuo to, kaip greitai toliau keisis pasaulinė DI aparatinės įrangos rinka.

Jokūbas Žilinskas

Esu Jokūbas – aistringas dirbtinio intelekto ir žaidimų pasaulio tyrinėtojas. Digin.lt dalinuosi naujienomis ir analizėmis, kurios padeda suprasti technologijų ateitį.

Palikti komentarą

Komentarai

Komentarų dar nėra. Būkite pirmas.