Tehnologie. Digital. Inovație.
Ai

Z.ai lansează GLM-5.3-Flash: modelul ieftin care rulează pe cipuri chinezești

Z.ai a dezvăluit GLM-5.3-Flash, un model AI de cost redus care rulează pe cipuri chineze. Identificat ca Ox-alpha, are greutățile publice.

Z.ai lansează GLM-5.3-Flash: modelul ieftin care rulează pe cipuri chinezești

Cum a devenit Ox-alpha modelul GLM-5.3-Flash lansat de Z.ai?

Z. ai a dezvăluit oficial miercuri noul său model de inteligență artificială, GLM-5.3-Flash. Lansarea confirmă identitatea misteriosului „Ox-alpha”, modelul care a dominat recent traficul de utilizatori pe platforma OpenRouter.

Compania a pus imediat la dispoziția publicului greutățile (weights) modelului.

Această clarificare explică originea modelului care a crescut brusc în popularitate în ultimele zile. Prin asocierea identificatorului anonim cu un produs concret, Z. ai a oferit transparență dezvoltatorilor care experimentau cu acest sistem de performanță ridicată.

Mișcarea semnalează o împingere strategică în peisajul competitiv al modelelor de limbaj mari accesibile.

GLM-5.3-Flash este un model hibrid cu un total de 320 de miliarde de parametri. Totuși, utilizează o arhitectură sparsă, în care doar 18 miliarde de parametri sunt activi la fiecare pas de inferență.

Această alegere de design permite procesarea sarcinilor complexe fără a angaja întreaga greutate computațională a rețelei. Echipa de inginerie a optimizat specific modelul pentru operațiuni de inferență cu costuri ultrareduse.

O distincție cheie pentru această lansare este compatibilitatea hardware. Spre deosebire de mulți competitori care se bazează exclusiv pe GPU-urile Nvidia, GLM-5.3-Flash rulează direct pe cipuri chinezești domestice. Capacitatea aceasta abordează o îngrijorare critică a lanțului de aprovizionare pentru organizațiile care caută să reducă dependența de ecosistemele hardware occidentale. Modelul demonstrează că performanța de înaltă calitate nu necesită acceleratoare străine scumpe.

Procesul de antrenare s-a concentrat intens pe eficiența costurilor. Dezvoltatorii pot acum accesa greutățile pentru a integra modelul în propriile lor fluxuri de lucru.

Această accesibilitate scade bariera de intrare pentru echipele care construiesc aplicații care necesită un volum mare de tokeni. Natura hibridă a modelului asigură latența rămâne scăzută, menținând în același timp o performanță robustă.

Care este adevărata identitate a misteriosului Ox-alpha?

Adopția rapidă a Ox-alpha pe OpenRouter indică o cerere puternică pe piață pentru modele eficiente.

Utilizatorii au prioritarizat viteza și accesibilitatea față de numărul brut de parametri, favorizând sistemele care oferă valoare per dolar cheltuit. Decizia Z. ai de a demasca modelul validează această tendință. Sugerează că generația următoare de instrumente AI va prioritiza cheltuielile operaționale în fața mărimii pure.

Prin rularea pe siliciu chinezesc local, modelul oferă o alternativă viabilă pentru întreprinderile îngrijorate de suveranitatea datelor. De asemenea, reduce supraîncărcarea asociată cu importul de hardware specializat. Disponibilitatea deschisă a greutăților încurajează contribuțiile comunității și eforturile de fine-tuning. Acest abordare de ecosistem ar putea accelera dezvoltarea de derivate specializate, adaptate pentru industriile nișe.

Câți parametri utilizează GLM-5.3-Flash?

Modelul conține 320 de miliarde de parametri în total. Doar 18 miliarde dintre aceștia sunt activi în timpul inferenței, ceea ce menține costurile computaționale scăzute.

Ce hardware suportă acest nou model?

Z. ai a confirmat că GLM-5.3-Flash rulează pe cipuri chinezești domestice. Acest lucru îl face o opțiune potrivită pentru echipele care evită dependența de clusterurile standard de GPU-uri Nvidia.

Când a devenit modelul public?

Greutățile au fost lansate miercuri. Acest lucru a urmat câteva zile în care modelul opera anonim ca Ox-alpha pe platforma OpenRouter.

More stories:

Content written by Andrei Ionescu for stiri-blockchain.ro editorial team, AI-assisted.

Share:

Leave a comment