Viteza devine cheia?
Lumea inteligenței artificiale accelerează, iar giganții OpenAI și Google sunt la volan. Ambele companii au lansat recent modele îmbunătățite, punând un accent puternic pe rapiditatea procesării.
Culture picks
Tencent, între investiții masive în AI și provocări financiare
Telefonul cu cameră gimbal: O nouă eră în videografia mobilă?
Apple Silicon accelerează Stable Diffusion: Automat1111, cu 40% mai rapid
Telefoanele Pixel: Prețuri în creștere, RAM în scădere. Ce se întâmplă?Această tendință marchează o schimbare semnificativă pe piața AI, unde viteza devine o valoare de sine stătătoare, la fel de importantă ca inteligența brută.
Un exemplu elocvent este noul nivel „Ultrafast” de la OpenAI, disponibil momentan într-o fază de previzualizare pentru un grup restrâns de clienți.
Potrivit unui anunț făcut joi, 13 august, acest serviciu promite să ruleze modelul GPT-5.6 Sol de până la 14 ori mai rapid decât versiunea standard, atingând o viteză impresionantă de până la 750 de tokeni de ieșire pe secundă.
Deși modelul de bază rămâne același, această accelerare fulgerătoare este posibilă grație utilizării cipurilor produse de compania Cerebras.
Google: Gemini 3.7 Flash și prețuri competitive
Printre primele companii care testează această tehnologie se numără Jane Street, Podium, Basis și Rogo, care o aplică în domenii diverse, de la programare și cercetare financiară la suport clienți, aplicații vocale și comerț electronic.
Reprezentanții OpenAI au subliniat că, până acum, atingerea vitezei în timp real presupunea adesea compromisuri, utilizând modele mai mici sau mai specializate. Însă „Ultrafast” deschide o nouă direcție: mai multă muncă utilă pe secundă.
Nici Google nu s-a lăsat mai prejos, introducând în aceeași zi modelul său accelerat, Gemini 3.7 Flash. Costurile pentru acest model sunt de 0,75 dolari per milion de tokeni de intrare și 3,75 dolari per milion de tokeni de ieșire, valabile până pe 31 decembrie.
Aceasta reprezintă o reducere la jumătate față de prețul modelului Flash anterior. Începând cu 1 ianuarie 2027, prețurile se vor dubla, ajungând la nivelul modelului Gemini 3.6 Flash, conform unei postări de blog a companiei.
Viteza, noul criteriu de performanță
Google a evidențiat, de asemenea, o îmbunătățire a capacităților, numind Gemini 3.7 Flash „cel mai inteligent model de lucru de până acum pentru codare și agenți”.
Conform analizei firmei Artificial Analysis, Gemini 3.7 Flash a înregistrat o viteză de aproximativ 340 de tokeni pe secundă, depășind de aproape trei ori viteza modelelor GPT-5.6 Terra și GLM-5.2. Această performanță îl plasează la granița eficienței inteligenței versus timpul necesar pentru o sarcină. Ambele lansări subliniază o tendință clară: în ultimii doi ani, prețurile AI au fost determinate în principal de capabilitățile modelului și de volumul de utilizare. Acum, viteza se impune ca o a treia caracteristică distinctă pentru care companiile sunt dispuse să plătească.
viteza Importanța vitezei nu este universală, însă devine crucială în anumite scenarii. De exemplu, în cazul detectării fraudelor bancare, un sistem trebuie să acționeze într-o fracțiune de secundă.
Potrivit raportului PYMNTS Intelligence, „Where Payment Decisions Happen: How Issuer Data Is Powering the Next Era of Commerce”, detectarea fraudelor bazată pe AI a generat deja economii de cel puțin 5 milioane de dolari pentru 42% dintre emitenții de carduri.
O verificare lentă a fraudelor nu este doar enervantă; poate permite finalizarea unei tranzacții frauduloase înainte ca sistemul să intervină. În anunțul său, OpenAI a menționat aplicațiile vocale și suportul clienți ca fiind domenii în care viteza este esențială pentru o experiență fluidă și eficientă.
