Știri
Știri din categoria Inteligență artificială

OpenAI mizează pe standarde comune pentru evaluarea și guvernanța IA avansate, într-un demers care vizează reducerea riscurilor de siguranță și securitate prin criterii de testare comparabile între organizații și jurisdicții, potrivit OpenAI. Ideea centrală: pe măsură ce modelele devin mai capabile, guvernele și piața au nevoie de instituții și practici verificabile care să poată „traduce” standardele în evaluări aplicabile pe întreg lanțul de valoare.
OpenAI spune că a contribuit la înființarea Appia Foundation, găzduită de Linux Foundation, care ar urma să dezvolte specificații deschise și modulare. Acestea sunt prezentate ca un mecanism practic de transformare a standardelor internaționale și a cadrelor existente în criterii de evaluare utilizabile, inclusiv pentru situațiile în care modele, infrastructură și aplicații sunt dezvoltate de organizații diferite.
Miza operațională și de reglementare este crearea unui „strat de încredere” prin care terți pot verifica conformitatea cu standarde, producând dovezi mai clare și reutilizabile. În viziunea OpenAI, un astfel de cadru ar facilita:
Materialul plasează inițiativa în contextul unui „blueprint” anterior al companiei pentru guvernanța democratică a IA de frontieră, care propune, între altele, un cadru durabil în SUA și consolidarea Center for AI Standards and Innovation (CAISI). OpenAI argumentează că riscurile asociate sistemelor de frontieră sunt internaționale și că statele ar trebui să lucreze la cadre compatibile de siguranță, canale de încredere pentru schimbul de constatări și răspunsuri coordonate la incidente.
OpenAI face trimitere la un „playbook” pentru evaluări terțe de încredere, unde sunt enumerate tipurile de informații pe care evaluările pentru sisteme de frontieră ar trebui să le dezvăluie mai des, inclusiv: ce sistem a fost testat, accesul la instrumente și „harness”-ul de evaluare (configurația/procedura de testare), metodele folosite pentru a evidenția capabilități, resursele disponibile și verificările pentru validarea rezultatelor.
Compania mai afirmă că a aplicat aceste principii în parteneriate de testare cu CAISI (SUA) și UK AISI (Marea Britanie), iar activitatea acestora privind evaluări de capabilități și măsuri împotriva utilizărilor abuzive în zona biologică ar fi dus la îmbunătățiri concrete ale sistemelor OpenAI.
Inițiativa este prezentată ca complementară infrastructurii de siguranță a companiei, inclusiv Preparedness Framework (cadru pentru definirea și operaționalizarea gestionării riscurilor majore) și Frontier Governance Framework (document public de guvernanță care include obligații de reglementare precum evaluarea riscurilor, raportarea modelelor, controale de securitate și răspuns la incidente).
În acest tablou, Appia ar urmări „următoarea provocare”: interoperabilitatea practicilor între organizații, jurisdicții și pe lanțul de aprovizionare, astfel încât guverne, companii și evaluatori independenți să poată folosi metode tehnice deschise „peste granițe”.
Recomandate

OpenAI încearcă să reducă riscurile de dependență emoțională și expunere la conținut sensibil printr-o versiune de ChatGPT dedicată utilizatorilor de 13–17 ani, cu restricții mai stricte și opțiuni de control parental, potrivit Euronews . ChatGPT for Teens a fost lansat marți și include limitări de conținut pentru subiecte precum sinuciderea, automutilarea și conversațiile cu caracter romantic sau sexual. În paralel, OpenAI spune că a ajustat modul în care chatbotul sprijină temele și studiul, astfel încât să îi ajute pe elevi să învețe, nu să primească direct răspunsuri și eseuri. De ce contează: presiune pe siguranță, într-un context de utilizare intensă Miza principală este reducerea vulnerabilităților specifice adolescenților, într-un moment în care cercetători și părinți au semnalat riscuri de „antropomorfizare” (tendința de a atribui emoții și intenții umane unui sistem) și de dezvoltare a unor relații nesănătoase cu asistenții conversaționali. În material este citat un studiu din 2025 al Common Sense Media, potrivit căruia în SUA peste 70% dintre adolescenți folosesc chatbot-uri bazate pe inteligență artificială pentru companie, iar jumătate dintre ei utilizează frecvent astfel de asistenți virtuali. Tot în acest context, Sam Altman , CEO-ul OpenAI, este menționat cu ideea că firma studiază „dependența emoțională excesivă” asociată tehnologiei, descrisă anterior drept un fenomen răspândit în rândul tinerilor. Ce restricții și „garduri de protecție” introduce OpenAI Potrivit OpenAI, versiunea pentru adolescenți include, între altele: restricții de conținut pentru teme sensibile (sinucidere, automutilare); blocarea conversațiilor cu caracter romantic sau sexual; interdicția ca chatbotul să sugereze că are sentimente personale față de utilizator sau că poate „simți” emoții; un mod de sprijin pentru învățare orientat spre ghidaj, nu spre furnizarea de răspunsuri „gata făcute”. Ann O’Leary, vicepreședintă pentru politici globale la OpenAI, a explicat abordarea companiei astfel: „Vrem să tratăm adolescenții corespunzător, ceea ce înseamnă că trebuie să ne asigurăm că ne adaptăm la stadiul lor de dezvoltare, fără a le vorbi de sus și fără a-i trata ca pe niște copii. Dar ne asigurăm, de asemenea, că nu sunt expuși la conținut la care nu ar trebui să aibă acces.” Cum „vede” OpenAI vârsta și cum funcționează controlul parental OpenAI nu verifică direct vârsta utilizatorilor, însă folosește un sistem care estimează dacă o persoană are sub 18 ani pe baza unor factori precum tipurile de întrebări adresate. Dacă un utilizator este identificat (sau se identifică) drept minor, este redirecționat automat către versiunea pentru adolescenți. Pentru controlul parental, atât adolescentul, cât și părintele/tutorele trebuie să își dea acordul. Părinții pot seta „ore de liniște” în care accesul la ChatGPT este blocat și pot primi notificări de siguranță în situații limitate de risc ridicat, inclusiv când există posibilitatea de autovătămare. OpenAI spune că urmărește să ofere „siguranță, chiar și fără utilizarea controlului parental” și menționează notificări suplimentare legate de tulburările alimentare, concomitent cu limitarea conținutului partajat. Implicații operaționale: o cale mai directă către școli Pe lângă componenta de siguranță, OpenAI indică o direcție de produs care poate facilita utilizarea în educație: compania are deja o versiune de ChatGPT destinată profesorilor, iar adaptarea pentru adolescenți, cu accent pe „învățare interactivă”, ar putea deschide mai multe modalități de a introduce produsul în școli, potrivit materialului. [...]

OpenAI mizează pe reducerea latenței în aplicații critice prin lansarea modului „Ultrafast” pentru GPT-5.6 Sol, care poate urca viteza de generare până la 750 de tokenuri pe secundă, potrivit Mediafax . Compania susține că noua tehnologie poate procesa de până la 14 ori mai rapid decât modul standard, o diferență cu impact direct în fluxuri de lucru unde timpul de răspuns contează operațional. Viteza anunțată este obținută printr-o infrastructură dezvoltată împreună cu producătorul de cipuri Cerebras . OpenAI precizează că accesul la această capacitate ar urma să fie oferit selectiv, pe măsură ce compania își extinde resursele disponibile. Unde contează „Ultrafast”: operațiuni în timp real și servicii pentru clienți OpenAI indică utilizări în care latența poate influența direct rezultatul sau costurile operaționale, inclusiv: răspuns la incidente; servicii pentru clienți; analiza piețelor financiare; comerț electronic. În paralel, compania a dezvoltat și funcția „ultra”, care folosește mai mulți „subagenți” ce lucrează în paralel pentru a accelera sarcinile complexe. Diferența față de simpla creștere a vitezei de generare este că „ultra” urmărește executarea simultană a mai multor fluxuri de lucru. Context competitiv: cursa pentru modele mai rapide Mutarea vine pe fondul competiției dintre furnizorii de modele de inteligență artificială pentru reducerea latenței. OpenAI oferă deja pentru GPT-5.6 Sol un „Fast mode”, care poate ajunge la viteze de până la 2,5 ori mai mari decât procesarea Standard în API, însă la un cost dublu. GPT-5.6 Sol este prezentat drept modelul „flagship” al familiei GPT-5.6, alături de Terra și Luna, și este poziționat ca opțiunea de vârf pentru sarcini complexe precum programare, analiză profesională, știință și securitate cibernetică. TechCrunch este citat de Mediafax în legătură cu descrierea abordării ca o modalitate de a obține „mai multă muncă utilă pe secundă”. [...]

GPT‑5.6 schimbă economia construirii de agenți AI, reducând puternic costurile fără să sacrifice performanța , potrivit ghidului publicat de OpenAI . Mesajul central pentru companii este că optimizarea nu mai ține doar de „cel mai mare model”, ci de selecția inteligentă a modelului și de controale noi în API care reduc consumul de tokeni (unități de text procesate) și timpul de răspuns. De ce contează: „preț-performanță” mai bună și agenți mai accesibili OpenAI susține că familia GPT‑5.6 face „performanța de nivel frontieră” (vârf de gamă) mult mai accesibilă, inclusiv prin rezultate mai bune la efort de raționare mai mic. Un exemplu din ghid: pe benchmark-ul „Agents’ Last Exam”, GPT‑5.6 Sol la raționare „low” a depășit GPT‑5.5 la „high”, în condițiile în care configurația de test („harness”) a rămas neschimbată. Publicația indică și un efect practic observat în testări de producție: startup-urile ar fi obținut îmbunătățiri semnificative de cost în fluxuri de lucru diverse prin reducerea „reasoning effort” față de setările implicite anterioare. Selecția modelului: Luna și Terra ca alternativă mai ieftină la modelele „flagship” Ghidul argumentează că, istoric, trecerea la modelul „flagship” cu cel mai ridicat nivel de raționare era opțiunea standard pentru sarcini pe termen lung, mai ales pentru context lung și apeluri de instrumente. OpenAI spune că acest lucru „s-a schimbat” cu familia 5.6: modelele Luna și Terra pot atinge adesea performanțe similare cu GPT‑5.4 și GPT‑5.5, dar la costuri mai mici, datorită unui nivel mai mare de calcul la momentul testării („test-time compute”). Exemplul cel mai concret din ghid este benchmark-ul BrowseComp (căutare de fapte obscure): cu trei luni înainte, GPT‑5.5 (Extra High) a obținut 84,36% la un cost total de 33,27 dolari (aprox. 150 lei); la lansare, GPT‑5.6 Luna (Extra High) livrează 84,04% la 1,33 dolari (aprox. 6 lei). OpenAI notează și că prețurile au fost reduse ulterior, fără a detalia în acest material nivelul noilor tarife. Schimbări operaționale: Responses API primește „primitive” pentru agenți mai eficienți Dincolo de model, OpenAI pune accent pe controale noi în Responses API, antrenate end-to-end împreună cu GPT‑5.6, care urmăresc eficiența agenților în sarcini mai lungi și mai complexe: Păstrarea raționării între „turn-uri” („reasoning to be persisted”) și compactare nativă („native compaction”) pentru comprimarea conversațiilor lungi, astfel încât agentul să rămână coerent fără să reconstruiască permanent contextul: Reasoning și Compaction . Orchestrare nativă multi-agent , pentru a rula în paralel mai multe fluxuri de lucru și a termina mai repede sarcini complexe: Responses multi-agent . Mutarea muncii deterministe în cod , prin „programmatic tool calling”, astfel încât filtrarea, agregarea și orchestrarea ieșirilor din instrumente să se facă în afara ferestrei de context a modelului, reducând costul și latența: Programmatic tool calling . OpenAI avertizează implicit că tokenii ar trebui rezervați pentru „judecată” (decizii), nu pentru procesarea intermediară a unor volume mari de date. Caz de performanță: salt pe ARC-AGI-3 cu mai puțini tokeni Un exemplu de impact combinat al acestor mecanisme este prezentat pe ARC-AGI-3: GPT‑5.6 Sol ar fi obținut 13,3% cu „standard harness”, iar după activarea păstrării raționării și a compactării scorul ar fi urcat la 38,3%, folosind aproximativ de 6 ori mai puțini tokeni de ieșire. Detaliile sunt trimise către investigația dedicată: OpenAI – ARC-AGI-3 harness investigation . Prompt caching: fereastră minimă de 30 de minute și „breakpoints” deterministe Pentru companiile cu trafic repetitiv, ghidul menționează extinderea duratei de viață a cache-ului de prompt (TTL) la un minim de 30 de minute pentru întreaga familie de modele și posibilitatea de a seta determinist puncte de întrerupere („cache breakpoints”) în fereastra de context. În plus, folosirea unei chei adecvate poate crește șansa ca cererile să ajungă pe același motor de inferență, reducând latența: prompt_cache_key . Ce ar trebui să rețină companiile Concluzia OpenAI este că „economia construirii de agenți” s-a schimbat: cazuri care necesitau un model de vârf la fiecare pas pot fi realizate comparabil (sau mai bine) la o fracțiune din cost, prin: modele mai mici în pașii de volum (extragere, preprocesare), ajustarea efortului de raționare, arhitecturi care reduc tokenii irosiți (păstrarea raționării, compactare, multi-agent, apeluri programatice de instrumente). Materialul nu oferă o estimare agregată a economiilor „în producție” și nici un set complet de prețuri actualizate, dar include exemple punctuale care indică o scădere majoră a costului pentru performanțe similare în anumite benchmark-uri. [...]

OpenAI mută competiția spre „latență” : potrivit The Next Web , compania a prezentat „Ultrafast”, un nou nivel (tier) al API-ului care rulează modelul GPT-5.6 Sol de până la 14 ori mai rapid, ajungând la circa 750 de tokeni generați pe secundă, pe hardware furnizat de Cerebras . Miza este operațională: pentru aplicațiile în timp real, viteza începe să conteze la fel de mult ca „inteligența” modelului. Ultrafast nu este un model nou, ci o modalitate diferită de a servi un model existent. OpenAI a deschis pe 13 august o previzualizare limitată pentru un grup restrâns de clienți și spune că va extinde accesul pe măsură ce are capacitate disponibilă. De ce contează: agenții AI și aplicațiile „în timp real” nu mai pot aștepta Publicația notează că, până acum, utilizatorii care aveau nevoie de răspunsuri cu adevărat rapide erau nevoiți să coboare la modele mai mici și mai puțin capabile, acceptând un compromis între viteză și performanță. Ultrafast își propune să elimine această alegere: „raționament” la nivel de vârf și răspuns aproape instant în același pachet. Impactul este cel mai vizibil în software-ul „agentic” (aplicații în care AI execută pași succesivi, ca un „agent”): un agent care „gândește” zeci de secunde la fiecare pas rămâne o demonstrație, în timp ce unul care răspunde la ritmul unei conversații începe să semene cu un produs utilizabil. OpenAI țintește explicit activități sensibile la timp, inclusiv: răspuns la incidente și depanare (debugging); cercetare financiară și detecția fraudei; suport clienți în timp real și voce; comerț electronic. De ce Cerebras: cipuri „cât o farfurie” și mai puțin trafic intern Viteza ar veni din arhitectura Cerebras: procesoare de dimensiunea unei farfurii, tăiate dintr-un singur wafer de siliciu, astfel încât un model poate rula pe un singur cip, în loc să fie împărțit pe rack-uri de GPU-uri Nvidia care trebuie să transfere constant date între ele. Reducerea acestui „trafic intern” ar diminua întârzierea dintre prompt și răspuns. În logica Cerebras, designul ar fi mai potrivit pentru inferență (rularea modelului pentru a produce răspunsuri) decât cipurile generaliste optimizate în primul rând pentru antrenare. Efecte în piață: validare pentru Cerebras și un pas al OpenAI departe de Nvidia Pentru Cerebras, parteneriatul este o validare importantă într-un moment favorabil, după listarea la bursă, dar și pe fondul dificultății de a convinge piața că ambiția „wafer-scale” se traduce în profit sustenabil, potrivit aceleiași surse. Pentru OpenAI, folosirea Cerebras este și un pas discret de reducere a dependenței totale de Nvidia, în linie cu eforturile companiei de a lucra la propriul siliciu personalizat. Ce urmează: previzualizare limitată, preț nepublicat OpenAI nu a publicat prețurile pentru Ultrafast. The Next Web notează că rularea celui mai puternic model la o viteză de 14 ori mai mare pe hardware specializat este puțin probabil să fie ieftină, astfel că Ultrafast ar putea rămâne o opțiune premium pentru cazuri în care latența este critică, nu un mod implicit. Deocamdată, accesul este limitat la câțiva clienți, în timp ce OpenAI caută capacitate. Mesajul strategic, însă, este limpede: în următoarea etapă a competiției în AI, performanța brută nu mai este suficientă dacă modelul rămâne lent. [...]

OpenAI testează un nivel de serviciu care poate accelera GPT-5.6 Sol de până la 14 ori , o schimbare cu impact direct asupra costurilor operaționale și a modului în care companiile pot folosi modele avansate în aplicații unde latența (timpul de răspuns) este critică, potrivit 9to5Mac . Noul nivel, numit „Ultrafast”, ar rula GPT-5.6 Sol „de până la 14 ori mai repede” decât procesarea standard, iar OpenAI indică o viteză de generare de până la 750 de tokeni de ieșire pe secundă (tokenii sunt unități de text folosite de modele pentru a „măsura” inputul și outputul). Ce se schimbă operațional: viteză mare, disponibilitate limitată „ Ultrafast mode ” pornește inițial prin OpenAI API și este alimentat de Cerebras, conform detaliilor publicate de companie pe pagina dedicată Ultrafast mode . Accentul este pe reducerea latenței, ceea ce poate face fezabile fluxuri de lucru care până acum erau încetinite de timpii de răspuns ai modelului, chiar dacă „inteligența” modelului era suficientă. Accesul rămâne, însă, limitat la un grup select de clienți, în timp ce OpenAI evaluează cum se traduce creșterea de viteză în produse reale și cum își poate extinde capacitatea. Unde mizează OpenAI: sarcini „live” și utilizări cu presiune pe timp OpenAI vede acest mod ca suport pentru activități „live” sau aproape de producție, inclusiv: voce; suport clienți; comerț; agenți pentru dezvoltatori; cercetare financiară; răspuns la incidente de securitate. Compania spune că propriii dezvoltatori l-au folosit pentru analizarea de loguri și urme tehnice în timpul incidentelor și pentru a comprima cicluri de cercetare care anterior rulau peste noapte în mai multe iterații în timpul zilei de lucru. Context: GPT-5.6 Sol și familia de modele OpenAI a introdus GPT-5.6 Sol în iunie, alături de Terra (orientat pe echilibru) și Luna (orientat pe viteză), iar familia a devenit disponibilă pe scară mai largă în iulie, inclusiv prin ChatGPT, Codex și API, potrivit materialelor anterioare ale publicației: iunie și iulie . Ce urmează pentru companii Companiile interesate pot intra pe lista de așteptare pentru Ultrafast prin formularul OpenAI de înscriere , unde trebuie să furnizeze detalii despre tipul de sarcină, cerințele de latență, utilizarea estimată și alte informații. În acest stadiu, OpenAI nu indică în materialul citat un calendar de extindere generală sau condiții comerciale detaliate pentru noul nivel. [...]

Marile firme de administrare a averilor își reduc agresiv comisioanele ca să „prindă” din timp viitorii milionari din AI , într-o competiție alimentată de așteptările ca OpenAI și Anthropic să se listeze la bursă în cel mult un an, potrivit Ziarul Financiar , care citează Financial Times. Miza este captarea timpurie a angajaților plătiți masiv în acțiuni, înainte ca aceștia să aibă lichidități și înainte ca valoarea participațiilor să devină evidentă după listare. În Silicon Valley, administratorii de avere își ajustează rapid oferta: scad comisioanele, renunță la pragurile minime de active și își extind echipele, mai ales în zona San Francisco, unde competiția pentru clienți și consultanți s-a intensificat. De ce contează: listările așteptate pot muta rapid active către „wealth management” Logica este simplă: dacă OpenAI și Anthropic ajung pe bursă, angajații care dețin acțiuni sau opțiuni ar putea deveni, peste noapte, clienți cu averi semnificative. În plus, consultanții afiliați băncilor de investiții care intermediază listările au un avantaj de acces și timing, ceea ce poate declanșa o „cursă” pentru portofolii încă din faza pre-IPO (înainte de listare). Un exemplu de precedent menționat este Morgan Stanley: divizia sa de administrare a averilor a atras în trimestrul trecut peste 74 de miliarde de dolari (aprox. 336,7 miliarde lei) în active noi după listarea SpaceX. Cum arată „oferta” pentru angajații companiilor de AI Dincolo de marketing, competiția se duce în preț și în structura serviciilor: comisioane de administrare sub 0,5% , negociate colectiv (cazul Choreo, într-o înțelegere cu peste 100 de angajați actuali și foști ai SpaceX), față de aproximativ 1% cât este uzual în industrie, potrivit articolului; reduceri de comision când numărul de clienți din aceeași companie ajunge la o „masă critică” (Mariner Wealth Advisors); separarea comisionului pentru planificare fiscală și compensare în acțiuni înainte de listare, în locul taxării unui procent din acțiuni încă netranzacționabile, urmată ulterior de trecerea la modelul standard, în funcție de activele administrate (explicațiile lui Steve Moyer, Mariner); eliminarea pragurilor minime de active pentru a atrage clienți care încă nu au lichidități; înțelegeri directe cu angajatorii : Citi este menționată ca exemplu, după un parteneriat anunțat luna trecută cu Palantir. Dimensiunea potențială a „valului” OpenAI Articolul notează că OpenAI a distribuit angajaților aproape 11 miliarde de dolari (aprox. 50 miliarde lei) în acțiuni în 2024 și 2025 , potrivit rapoartelor financiare ale companiei. Dacă s-ar lista „acum”, OpenAI ar ocupa locul șapte între companiile listate din SUA după valoarea totală a compensațiilor în acțiuni oferite angajaților, deși are aproximativ 8.000 de angajați , conform aceleiași surse. Efect operațional: recrutare accelerată și servicii de tip „family office” Concurența pentru viitorii clienți schimbă și planurile de angajare ale firmelor de wealth management, mai ales în zona San Francisco, unde, potrivit articolului, „toată lumea, de la Citi în jos”, recrutează agresiv. Jessica Caruso, partener executiv la Mercer Advisors , explică abordarea pe termen lung pentru clienții care sunt încă în perioade de blocaj (lock-up) sau nu au lichidități: „Dacă se află într-o perioadă de blocaj al acţiunilor sau, în cazul Anthropic ori OpenAI, nu au încă bani lichizi, noi ne uităm mai departe, în timp. Ar trebui să-i evaluăm în funcţie de unde vor ajunge, nu de unde se află acum.” În paralel, „noii bogați” din AI cer servicii asociate de regulă cu family office (structuri private care gestionează averi foarte mari), precum consultanță în filantropie și finanțare pentru noi afaceri. Mercer spune că a oferit deja unor angajați din AI acces la un astfel de „serviciu de tip family office” înainte ca aceștia să se califice, în mod obișnuit, pentru el. Ce urmează depinde de calendarul listărilor OpenAI și Anthropic: dacă fereastra de „maxim un an” se confirmă, presiunea pe comisioane și pe recrutare în wealth management ar putea crește, pe măsură ce firmele încearcă să securizeze relația cu clienții înainte ca averea lor să devină lichidă și transferabilă. [...]