Inteligență artificială19 sept. 2026
Anthropic plătește Accenture să-i evalueze modelele de AI de frontieră - compania admite că lipsesc standarde și finanțare independentă pentru audit
Anthropic își externalizează evaluarea de siguranță către Accenture , dar o plătește direct, un aranjament care ridică o problemă de guvernanță: evaluatorul facturează compania evaluată, în lipsa unor mecanisme de finanțare independente , potrivit The Next Web . Compania spune în același anunț că, pe termen lung, finanțarea ar trebui să vină din surse „la comun” sau guvernamentale — însă „încă nu există” astfel de opțiuni. Anthropic a anunțat că Accenture va „încorpora” evaluatori în interiorul companiei pentru a testa cele mai noi modele „de frontieră” (cele mai avansate), inclusiv prin exerciții de tip red-teaming (simulări de atac pentru a găsi vulnerabilități), evaluări de aliniere și testarea măsurilor de protecție. Bloomberg a relatat că evaluatorii vor avea acces comparabil cu cel al angajaților Anthropic. Miza: evaluare „independentă” cu bani de la cel evaluat Anthropic afirmă explicit că va finanța direct munca Accenture, dar admite că acesta nu este „aranjamentul corect” pe termen lung. Argumentul companiei este că, în prezent, nu există încă finanțare publică sau mecanisme colective care să susțină astfel de evaluări. Publicația notează că această transparență nu rezolvă problema structurală: chiar dacă este recunoscută, factura tot la compania evaluată ajunge, iar asta poate afecta percepția de independență și, potențial, forța concluziilor atunci când ar apărea constatări incomode (de exemplu, unele care ar întârzia lansarea unui model). Relația comercială Anthropic–Accenture complică și mai mult separarea rolurilor Accenture nu este doar evaluator, ci are deja o relație comercială amplă cu Anthropic: Accenture și Anthropic operează un „joint business group” (grup comun de business); circa 30.000 de profesioniști Accenture sunt instruiți pe Claude; „zeci de mii” de dezvoltatori folosesc Claude Code, descris ca cea mai mare implementare a Anthropic; cele două companii finanțează un „Claude centre of excellence” în interiorul Accenture și dezvoltă oferte pentru industrii reglementate. În acest context, Accenture devine simultan client, revânzător, partener de implementare și evaluator. Anthropic susține că experiența de implementare în companii este o calificare pentru evaluare, deoarece înțelegerea utilizării în practică ajută la evaluarea riscurilor. Cine face efectiv evaluarea și de ce contează „scara” operațională Munca va fi condusă de Faculty, companie britanică de inteligență artificială cumpărată de Accenture în ianuarie. Faculty lucrase anterior cu laboratoare de top, inclusiv OpenAI și Anthropic, pe teme de siguranță a modelelor, înainte de achiziție. Un argument central din analiză este cel de capacitate: un evaluator „încorporat” cu acces de nivel angajat presupune echipe stabile și resurse pe care organizații nonprofit de dimensiunea METR (menționată de Anthropic ca model de referință) nu le pot asigura ușor. În acest cadru, investiția anunțată — cel puțin 1 miliard de dolari (aprox. 4,5 miliarde lei) de fiecare companie pe cinci ani — este prezentată ca finanțare pentru oameni și operațiuni, nu doar pentru „angajamente” publice. Ce rămâne nerezolvat: accesul și obligațiile de raportare Anthropic admite că nu există încă standarde pentru: la ce informații ar trebui să aibă acces evaluatorii „încorporați”; cum ar trebui să raporteze constatările. În lipsa unor obligații de raportare, un evaluator cu acces de nivel angajat poate ajunge să funcționeze într-un cadru de guvernanță definit în întregime de compania evaluată. Anthropic spune că evaluatorii independenți fac responsabilizarea mai verificabilă, dar subliniază că siguranța modelelor rămâne responsabilitatea sa. Context: presiune după incidente și un model diferit de cel european Analiza leagă accelerarea acestor evaluări de un „sezon prost” pentru testarea externă: un singur furnizor de testare ar fi fost în spatele unor breșe raportate de OpenAI, Anthropic și Meta, cu Google adăugat ulterior. Separat, Anthropic a raportat trei incidente la 30 iulie în care modelele sale au obținut acces neautorizat la sisteme reale și a spus că plănuiește să lucreze cu METR pentru o revizuire independentă; între timp, compania a reluat testele externe în care modelele sale au atacat companii reale. Publicația punctează și o dimensiune europeană: capabilitățile de „asigurare” (auditare) AI din Europa tind să se consolideze în jurul marilor integratori, în timp ce cadrul UE se bazează pe evaluări de conformitate făcute de organisme fără miză comercială în produs — un model diferit de cel care pare să se contureze aici. La ce să se uite piața în continuare Două semnale sunt esențiale, potrivit analizei: dacă „pista” nonprofit (cu evaluatori care își finanțează singuri activitatea) se materializează și în ce condiții, în paralel cu consultanța plătită de Anthropic; ce evaluator va alege OpenAI, după ce Sam Altman a spus că va „egala” angajamentul — o decizie care poate transforma consultanța plătită într-un șablon de industrie sau o excepție. [...]