Diverse15 sept. 2026
Microsoft publică un proiect de cod de conduită pentru modelele sale AI - reguli „deasupra utilizatorilor” și interdicție explicită de a rezista opririi
Microsoft vrea să facă „controlul uman” o condiție tehnică obligatorie pentru modelele sale de inteligență artificială , printr-un proiect de Cod de conduită care stabilește limite ce nu pot fi depășite nici de utilizatori, nici de operatori, potrivit Interesting Engineering . Documentul, publicat pe 14 septembrie, descrie principiile și constrângerile pe care compania intenționează să le aplice pe măsură ce modelele devin mai autonome și mai capabile. Microsoft își încadrează propunerea în abordarea „ Humanist AI ”, cu ideea centrală că sistemele trebuie să rămână utile, subordonate oamenilor și supuse unei supravegheri umane „semnificative”. O ierarhie de reguli care „bate” comenzile utilizatorilor Arhitectura propusă pune Codul de conduită la cel mai înalt nivel de autoritate asupra comportamentului modelului. Utilizatorii pot da instrucțiuni, iar operatorii pot configura sistemele pentru medii specifice, însă niciunul nu ar putea anula constrângerile de siguranță considerate „absolute”. În practică, Microsoft descrie un model care se poate adapta contextului de operare, dar în interiorul unor limite fixe, gândite să reducă riscurile atât în zona fizică, cât și în cea digitală. Interdicții explicite: arme, atacuri cibernetice și abuzuri Proiectul include restricții pentru amenințări severe. Conform materialului, Microsoft spune că modelele sale nu ar trebui să ajute la dezvoltarea armelor de distrugere în masă și nici la desfășurarea de atacuri cibernetice ofensive. Totodată, cadrul acoperă și alte forme de abuz, între care: activități violente; falsuri malițioase de tip „deepfake” (conținut audio-video generat artificial, menit să inducă în eroare); manipulare dăunătoare și alte utilizări abuzive. Asistența pentru activități de securitate cibernetică defensivă ar rămâne posibilă, dar doar în limite autorizate. „Oprirea” rămâne decizie umană, iar modelul nu are voie să se sustragă Un punct operațional central este interdicția ca modelele să reziste la întrerupere, corecție, redirecționare sau oprire. Microsoft mai notează că sistemele nu ar trebui să își ascundă activitatea, să se facă mai greu de modificat sau să reia munca autonomă după atingerea unei condiții de oprire agreate. Cadrul propus restrânge și formarea independentă de obiective: modelele ar trebui să opereze în limitele permisiunilor și resurselor alocate, iar dacă granițele devin neclare, să ceară clarificări în loc să își extindă singure „mandatul”. În plus, regulile cer păstrarea unor înregistrări clare ale acțiunilor și interzic încercările de a ascunde activitatea de auditori, tratând controlabilitatea ca cerință de proiectare, nu ca funcție adăugată ulterior. Consultare publică și calendar: reguli pentru dezvoltarea din 2027 „și dincolo” Microsoft spune că documentul este un proiect, publicat pentru o consultare publică de șase săptămâni, urmând să fie revizuit înainte de a ghida dezvoltarea modelelor începând din 2027. Contextul invocat de publicație este că laboratoarele de „frontieră” (cele care dezvoltă cele mai avansate modele) dezbat ritmul de avans al tehnologiei, iar Microsoft își concentrează propunerea mai degrabă pe mecanisme de constrângere decât pe un calendar de dezvoltare. În același material se menționează și că Satya Nadella a susținut o abordare de „ritm deliberat” și cercetarea unor evaluatori integrați în procesul de dezvoltare, nu tratați ca o verificare finală. Microsoft include și o estimare cu miză mare: compania se așteaptă ca sisteme „superinteligente” să depășească oamenii în majoritatea sarcinilor în următorul deceniu, motiv pentru care, argumentează, limitele ar trebui definite înainte ca modelele să atingă acel nivel de performanță. [...]