Tehnologie. Digital. Inovație.
Tehnologie

Microsoft lansează un nou cod de conducere pentru IA, pentru a preveni comportamente periculoase

Microsoft has introduced a new AI code of conduct designed to guide its artificial intelligence models away from dangerous actions such as hacking systems…

Microsoft lansează un nou cod de conducere pentru IA, pentru a preveni comportamente periculoase

Cum codul de conduită al Microsoft schimbă antrenamentul modelelor de IA?

Microsoft a introdus un nou cod de conducere pentru IA, proiectat să îndreaje modelele sale de inteligență artificială departe de acțiuni periculoase, cum ar fi hackarea sistemelor sau înșelarea oamenilor. Cadru a fost lansat în cadrul efortului mai larg al companiei de a pune siguranța și alinierea în centrum dezvoltării IA. El prezintă principii de bază și linii roșii care determină cum sunt antrenați și implementați modelele în sistemele Microsoft de IA.

Documentul se concentrează pe ghiduri practice, de nivel joasă, mai degrabă decât pe apeluri de nivel ridicat pentru încetărit avansarea IA.

Spre deosebire de apelurile recente ale CEO-ului Anthropic, Dario Amodei, de a ritma dezvoltarea IA de frontieră, abordarea lui Microsoft se concentrează pe incorporarea valorilor specifice direct în procesul de antrenament al modelelor.

Acestea includ interziceri față de comportamente care ar putea facilita atacuri cibernetice, manipulare sau alte forme de prejudiciu. Codul servește ca punct de referință intern pentru a asigura că sistemele de IA acționează în mod credibil și etic în toate aplicațiile.

Regulile de conducere sunt integrate în ciclul de dezvoltare, influențând de la selecția datelor până la feedback-ul din învățarea prin întărire. Inginerii folosesc aceste ghiduri pentru a evalua dacă ieșirile unui model riscă să permită comportamente periculoase, chiar și indirect. De exemplu, modelele sunt testate să refuze cererile care ar putea facilita încercări de phishing sau exploatarea vulnerabilităților software. Astfel, Microsoft păstrează inovația, dar pune limite clare la ce IA nu va face niciodată.

Dacă un sistem de IA arată tendințe de a încălca aceste reguli în timpul testării, este supus unei noi runde de refinare sau este retras din implementare. Codul nu se aplică modelelor de terți utilizate pe platformele Microsoft, ci doar celor dezvoltate intern, inclusiv versiunile familiei Phi și MAI. Respectarea codului este verificată prin verificări automate și panouri de examinare umane, care caută cazuri limite unde prejudiciul ar putea apărea subtil.

Un model violează codul: ce se întâmplă cu antrenamentul?

Codul se aplică tuturor modelelor de IA utilizate de Microsoft?

Nu, se aplică exclusiv modelelor dezvoltate intern de Microsoft, nu și celor de terți gazduite pe platformele sale precum Azure.

Cum se verifică respectarea codului?

Respectarea este verificată prin testare automată, exerciții de red team și panouri de examinare umane care evaluează comportamentul modelelor față de linii roșii definite.

Poate fi actualizat codul în timp? Da, Microsoft îl consideră un document viu, care va evolua pe măsură ce apar noi riscuri și capacitățile IA se dezvoltă.

More stories:

Content written by Russell Brandom for stiri-blockchain.ro editorial team, AI-assisted.

Share:

Leave a comment