Cine alimentează AI-ul american?
În Statele Unite, companii precum Surge AI și Mercor joacă un rol crucial, furnizând pachete de date de instruire esențiale atât laboratoarelor de inteligență artificială, cât și agențiilor federale. Aceste seturi de date sunt folosite pentru a antrena modele lingvistice majore și alte sisteme de inteligență artificială, inclusiv cele guvernamentale și de informații.
Culture picks
NASA spune că un proiect de lege de miliarde de dolari pentru un rover Moon reciclat este pur și simplu prea mare
Trebuie să reescriu ca articol de știri engleză, 350-600 de cuvinte. Utilizați doar fapte de la sursă. Sursa
AI-ul învață să coopereze, sfidând teoriile clasice
Referințe de chimie cuantică sub examinareDocumente recente, citate de Anna Tong în Forbes, dezvăluie că firme americane de etichetare a datelor, precum Surge AI și Mercor, sunt principalii furnizori de seturi de date de instruire. Acestea sunt vândute laboratoarelor AI din SUA și chiar guvernului, contribuind la dezvoltarea rapidă a tehnologiilor de inteligență artificială. Procesul de etichetare a datelor implică adnotarea și clasificarea informațiilor, transformându-le în materiale utile pentru antrenarea algoritmilor.
Piața etichetării datelor este una dinamică, unde companii specializate colectează, organizează și etichetează volume impresionante de informații.
Acestea devin apoi materia primă pentru dezvoltatorii de AI, care le utilizează pentru a învăța sistemele să recunoască modele, să înțeleagă limbajul natural sau să efectueze sarcini complexe.
Cum funcționează piața datelor?
Fără aceste seturi de date bine structurate, progresul în domeniul inteligenței artificiale ar fi mult încetinit.
De exemplu, un model lingvistic mare (LLM) numit SubQ (posibil Subquadratic) a fost proiectat pentru un raționament de 12 milioane de token-uri, demonstrând complexitatea și volumul de date necesar pentru astfel de sisteme.
Ce rol au companiile de etichetare a datelor?
Companiile de etichetare a datelor, precum Surge AI și Mercor, sunt esențiale pentru dezvoltarea inteligenței artificiale, furnizând seturi de date antrenament pentru laboratoarele AI și guvernul SUA. Aceste date sunt folosite pentru a învăța modelele AI să proceseze și să înțeleagă informații.
Cine alimentează cu adevărat creierul AI-ului american?!
Cine beneficiază de aceste servicii?
Principalii beneficiari sunt laboratoarele de inteligență artificială din SUA și agențiile guvernamentale, care utilizează seturile de date pentru a-și antrena modelele lingvistice și alte sisteme AI, inclusiv cele cu aplicații în domeniul securității și informațiilor.
Ce este un LLM precum SubQ?
SubQ (posibil Subquadratic) este un model lingvistic mare (LLM) conceput pentru a gestiona un raționament complex, de până la 12 milioane de token-uri. Aceste modele necesită cantități masive de date etichetate pentru a funcționa eficient și a oferi rezultate precise.

