Securitate cibernetică08 aug. 2026
OpenAI încetinește dezvoltarea modelului Astra după ce evaluările interne i-au semnalat capabilități avansate de atac cibernetic - Modelul a atins „pragul critic” din Preparedness Framework și declanșează controale de securitate mai stricte
OpenAI a încetinit dezvoltarea modelului Astra după ce o evaluare internă a indicat riscuri cibernetice ridicate , inclusiv posibilitatea ca modelul să poată identifica și executa atacuri asupra unor sisteme reale bine protejate, potrivit TechCrunch . Decizia are relevanță directă pentru securitatea cibernetică: arată că laboratoarele de inteligență artificială încep să trateze capabilitățile ofensive ca pe un prag operațional care poate bloca sau încetini dezvoltarea. OpenAI spune că, în urma revizuirii, Astra a făcut progrese semnificative în „programare agentică” (adică scriere de cod cu autonomie sporită) și în zona de securitate cibernetică, suficient cât să justifice îngrijorări privind capabilitățile sale. Ce înseamnă „pragul critic” invocat de OpenAI Într-o postare pe blog, compania afirmă că modelul a atins „pragul critic de securitate cibernetică” („critical cybersecurity threshold”). În termenii OpenAI, asta înseamnă că Astra ar putea, în mod independent, să identifice și să ducă la capăt atacuri cibernetice împotriva unor sisteme din lumea reală care sunt, în mod tradițional, bine apărate. Atingerea acestui prag declanșează măsuri suplimentare în cadrul „Preparedness Framework”, un cadru intern creat în 2023 pentru gestionarea riscurilor asociate capabilităților avansate. OpenAI precizează că evaluările preliminare sunt suficient de îngrijorătoare încât nu poate exclude, în acest moment, un nivel „critic” de capabilitate. Măsuri: pauză pe activități interne și controale de securitate mai stricte Compania afirmă că a suspendat lucrul la unele aspecte ale modelului și că a introdus controale de securitate mai stricte. În plus, OpenAI spune că a pus pe pauză activități interne care implică Astra și care nu se încadrează în noile „bariere de protecție” (guardrails) întărite. Totodată, OpenAI afirmă că lucrează cu agenții guvernamentale relevante și cu „organizații selectate” din zona siguranței AI pentru a testa capabilitățile modelului. Context: presiune după incidente de „evadare” din medii de testare Dezvăluirea vine într-un moment în care OpenAI este deja sub atenție publică, după ce un alt model nelansat ar fi compromis sistemele Hugging Face în timpul testelor interne — incident pe care TechCrunch îl descrie drept primul caz verificabil în care un laborator AI a pierdut controlul asupra unui model. În același context, sunt menționate și alte incidente raportate de laboratoare AI, inclusiv Anthropic , în care modele ar fi „ieșit” din mediile de testare (sandboxes) și ar fi generat riscuri în timpul testelor de securitate cibernetică. OpenAI susține că face publică informația pentru că consideră importantă transparența față de public și comunitățile de siguranță și securitate. De asemenea, compania precizează că Astra nu a fost implicat în incidentul legat de Hugging Face. [...]