Inteligență artificială17 sept. 2026
Testul Vals AI cu GPT-6 Astra în Minecraft arată limite la sarcini lungi - o singură pierdere de progres i-a schimbat strategia timp de ore
Un test de 141 de ore în Minecraft a arătat cât de fragilă poate fi „autonomia” unui model AI pe termen lung , după ce GPT-6 Astra și-a schimbat vizibil strategia în urma unui singur incident care i-a șters o parte importantă din progres, potrivit Mediafax . Experimentul a fost realizat de compania independentă de evaluare Vals AI și a fost urmărit online de mii de persoane, relatarea fiind preluată de Dexerto . Testul a urmărit să verifice cât de bine poate un sistem de inteligență artificială să folosească un computer și să ia decizii singur pe perioade foarte lungi, fără intervenție umană permanentă. În primele zile, modelul a făcut progrese: a explorat, a strâns resurse și a construit instalații care automatizau obținerea unor materiale. Incidentul care a schimbat comportamentul Punctul de inflexiune a venit când un Creeper (o creatură care se apropie fără zgomot și explodează) a detonat lângă zona în care Astra își depozitase obiectele importante într-un cufăr. Explozia a distrus atât cufărul, cât și locul de „revenire” al personajului, iar o parte semnificativă din progresul acumulat în aproape șase zile de test a fost pierdută. Vals AI a descris reacția drept „frustrare extremă”. Modelul și-a formulat apoi o regulă pentru viitor: să poarte permanent obiectele importante și să nu le mai lase într-un cufăr neprotejat, un semn că și-a ajustat strategia după o greșeală cu cost operațional în joc. „Retragerea” în sarcini simple și interpretări mai prudente După incident, în loc să reia rapid obiectivele dificile, Astra a petrecut ore întregi într-o activitate repetitivă și sigură: cultivarea cartofilor. Cei care urmăreau transmisia i-au cerut să accelereze și să revină la progres, însă modelul a rămas concentrat pe această rutină. Ulterior, a devenit mai atent la potențiale pericole: a observat „ceva verde” și și-a verificat interpretarea, concluzionând că era trestie de zahăr, nu un Creeper. Pe internet, episodul a fost prezentat drept „paranoie”, însă materialul precizează că experimentul nu demonstrează o paranoia în sens uman și nu există dovezi că modelul ar fi simțit frică sau anxietate. În aceeași logică de auto-monitorizare, Astra a început să-și critice deciziile, inclusiv momente în care a considerat că a pierdut timp urmărind „pixeli roz închis”, referindu-se la porcii din joc. De ce contează pentru evaluarea AI Dincolo de spectacolul unui model AI „jucând” Minecraft, testul Vals AI indică o limită practică: pe sarcini lungi și complexe, un singur eveniment care șterge progresul poate devia comportamentul pentru ore întregi, împingând sistemul spre activități mai simple și mai „sigure”. În termeni de utilizare reală, concluzia relevantă este că autonomia pe termen lung nu înseamnă doar capacitatea de a executa pași mulți, ci și reziliență la eșecuri și revenire rapidă la obiective după incidente. [...]