Știri
Știri din categoria Inteligență artificială

OpenAI își extinde distribuția în cloud dincolo de Microsoft, după ce modelele sale vor fi disponibile pentru prima dată în Amazon Bedrock, mișcare care poate schimba opțiunile de achiziție și integrare pentru companiile care folosesc servicii AWS, potrivit TechRadar.
Parteneriatul vine la o zi după ce OpenAI a anunțat că Microsoft nu mai este partenerul său exclusiv de cloud, deși rămâne „partener prioritar”. În noul aranjament, clienții Amazon Bedrock vor putea accesa modele GPT și alte modele asociate, iar agentul Codex va putea fi integrat în medii AWS.
Integrarea pune modelele OpenAI „lângă” alte opțiuni deja disponibile în Bedrock, inclusiv de la Anthropic, Meta, Mistral, Cohere și Amazon, plus „alți furnizori de top”, conform informațiilor din material.
TechRadar notează că pachetul include și „cel mai bun model de frontieră” al OpenAI, GPT‑5.5. Odată cu disponibilitatea în Bedrock, companiile păstrează accesul la funcții tipice de utilizare enterprise din AWS, precum:
Amazon evidențiază integrarea Codex și menționează că produsul are patru milioane de utilizatori săptămânali. Potrivit articolului, Codex este disponibil prin Codex CLI, aplicația desktop Codex și extensia pentru Visual Studio Code.
Atât Codex în Bedrock, cât și disponibilitatea modelelor OpenAI și a Amazon Bedrock Managed Agents alimentați de OpenAI sunt, deocamdată, în regim de „limited preview” (acces limitat), ceea ce indică o lansare etapizată, nu o disponibilitate generală imediată.
Dezvoltarea vine la câteva săptămâni după ce Amazon a anunțat un „parteneriat strategic multianual” cu OpenAI, care ar include o investiție de 50 miliarde dolari (aprox. 230 miliarde lei) în companie, conform TechRadar.
În cadrul acelui acord, OpenAI ar urma să consume 2 GW de capacitate Trainium (cipuri/acceleratoare AWS pentru antrenarea modelelor) prin infrastructura AWS, iar cele două companii ar urma să dezvolte împreună modele personalizate pentru aplicațiile orientate către clienți ale Amazon. TechRadar mai menționează că acordul pe opt ani ar fi o extindere a unei înțelegeri anterioare, „în valoare combinată” de 138 miliarde dolari (aprox. 635 miliarde lei).
AWS descrie acest pas drept „începutul unei colaborări mai profunde”, iar eliminarea exclusivității cu Microsoft poate deschide calea pentru extinderi similare și cu alți furnizori de cloud.
Recomandate

Amazon își restrânge portofoliul intern de modele Nova pentru a concentra bugetul și puterea de calcul pe un singur „foundation model” competitiv , potrivit The Next Web . Mișcarea are un impact operațional direct: majoritatea produselor Nova intră în regim de întreținere („keep the lights on”), rămânând suportate pentru clienții existenți, dar fără a mai fi o prioritate de dezvoltare. Publicația notează, citând o informație apărută inițial în Business Insider, că Amazon a început să deprecieze (să scoată treptat din uz) o parte importantă din linia Nova, inclusiv modelele de vârf Premier și Omni, generatorul video Reel și generatorul de imagini Canvas. În interior, unii angajați ar descrie situația drept „KTLO”, adică menținerea funcționării fără investiții semnificative în evoluție. Pariul se mută pe „Frontier Model Research” și un debut așteptat la re:Invent Resursele se reorientează către un efort numit Frontier Model Research (FMR), condus de Pieter Abbeel , intrat în Amazon odată cu achiziția din 2024 a startup-ului de robotică Covariant. Un nou model „fanion” este așteptat să fie prezentat la conferința Amazon re:Invent din această toamnă, potrivit Reuters, iar acesta ar putea păstra numele Nova. Schimbarea de direcție este pusă în contextul reorganizării conducerii: după ce, sub fostul șef AI Rohit Prasad, compania a împărțit efortul între modele de text, imagine și video, Peter DeSantis (care a preluat grupul consolidat în decembrie) ar fi concentrat talentul și capacitatea de calcul pe mai puține pariuri „frontier” (modele de vârf). Prasad a plecat la finalul lui 2025, iar fondatorul AGI Lab, David Luan, a plecat în februarie, mai arată articolul. Ce rămâne din Nova și ce se închide Nova nu dispare complet. Amazon ar păstra în portofoliu: Nova 2 Lite Nova 2 Sonic serviciul de personalizare Nova Forge instrumentul de agenți Nova Act În paralel, site-ul AGI din San Francisco – un grup de cercetare de 80 de persoane – a fost închis, potrivit GeekWire. De ce contează: Amazon își joacă diferențiatorul pe infrastructură, nu pe „brandul” de model The Next Web subliniază că Amazon nu a reușit să transforme Nova într-un nume „de masă” comparabil cu OpenAI, Anthropic sau Google, iar sistemele sale s-au dovedit costisitoare de rulat raportat la valoarea livrată. Presiunea a crescut și din partea rivalilor mai ieftini, într-un context mai larg de orientare către modele cu cost redus. În schimb, Amazon își consolidează avantajul tradițional: infrastructura. AWS găzduiește o parte importantă din industrie, cu angajamente de capacitate de calcul de 138 miliarde dolari (aprox. 621 miliarde lei) din partea OpenAI și peste 100 miliarde dolari (aprox. 450 miliarde lei) din partea Anthropic, iar cipurile proprii Trainium au devenit o afacere de ordinul miliardelor de dolari, pe care Jeff Bezos o numește un al patrulea pilon al companiei. Un purtător de cuvânt al Amazon respinge ideea unei retrageri, afirmând că modelele AI rămân printre cele mai importante priorități și că portofoliul este ajustat continuu în funcție de nevoile clienților. Miza imediată se mută la re:Invent: dacă Amazon poate trece de la rolul de „gazdă” și furnizor de cipuri pentru modelele altora la construirea unui model de vârf pe care dezvoltatorii să îl aleagă în mod activ în fața Claude, Gemini sau GPT. [...]

OpenAI taie agresiv costurile de utilizare pentru două modele, într-o mișcare cu impact direct asupra bugetelor de AI ale companiilor. Potrivit Neowin , OpenAI reduce prețurile pentru GPT-5.6 Luna cu 80% și pentru Terra cu 20%, pe fondul competiției tot mai dure cu modele dezvoltate în China. Reducerea de preț este relevantă în primul rând economic: pentru firmele care rulează aplicații bazate pe modele mari de limbaj, costul per utilizare (sau per volum de procesare) este adesea principalul factor care decide ce model ajunge în producție. O ieftinire de 80% la un model poate schimba rapid calculele de rentabilitate și poate accelera migrarea sau extinderea unor proiecte. Ce se schimbă: două reduceri, două niveluri de presiune pe piață Conform informațiilor din sursă, OpenAI aplică: o reducere de 80% pentru GPT-5.6 Luna ; o reducere de 20% pentru Terra . Neowin le plasează explicit în contextul concurenței cu „modelele chinezești”, ceea ce sugerează o strategie de apărare a cotei de piață prin preț, nu doar prin performanță. De ce contează pentru companii: costul devine armă competitivă În practică, astfel de ajustări pot avea câteva efecte imediate în piață: scăderea costului total pentru produse care folosesc AI la scară (asistenți, suport clienți, analiză de documente); presiune pe furnizorii alternativi (inclusiv cei din China) să răspundă cu reduceri sau pachete mai avantajoase; recalibrarea achizițiilor : echipele de produs și IT pot reevalua ce model folosesc, dacă diferența de preț depășește diferențele de calitate percepute. Sursa nu oferă detalii suplimentare despre noile tarife efective sau despre momentul exact al aplicării lor, dincolo de anunțul reducerilor procentuale. [...]

OpenAI reduce puternic costurile pentru GPT‑5.6 Luna și Terra, schimbare care poate coborî semnificativ factura companiilor pentru aplicații AI la volum mare , potrivit OpenAI , care anunță și un nou „Fast mode” în API pentru GPT‑5.6 Sol, orientat spre viteză. Începând de astăzi, GPT‑5.6 Luna (modelul „cel mai rapid și cel mai accesibil” din familie) va costa cu 80% mai puțin, iar GPT‑5.6 Terra (model „echilibrat” pentru lucru de zi cu zi) cu 20% mai puțin. Reducerile se reflectă și în modul în care consumul este contabilizat în abonamentele plătite atunci când modelele sunt folosite prin Codex și ChatGPT Work, ceea ce înseamnă că aceeași utilizare „mănâncă” mai puține credite, fără schimbarea prețurilor abonamentelor sau a bugetelor de cotă. Ce se schimbă în prețurile API și de când OpenAI publică și noile tarife pentru API, cu aplicare de la 30 iulie: GPT‑5.6 Terra : 2 dolari (aprox. 9 lei) per milion de tokeni de intrare și 12 dolari (aprox. 55 lei) per milion de tokeni de ieșire GPT‑5.6 Luna : 0,20 dolari (aprox. 1 leu) per milion de tokeni de intrare și 1,20 dolari (aprox. 6 lei) per milion de tokeni de ieșire GPT‑5.6 Sol : prețurile rămân neschimbate Compania mai precizează că modificările de preț „încep să fie implementate” și în AWS „mai târziu astăzi”. De ce contează pentru companii: optimizarea cost–viteză pe același flux Unghiul economic al anunțului este legat de posibilitatea de a împărți un flux de lucru pe etape, folosind modele diferite în funcție de costul erorii, urgență și volum. OpenAI dă exemplul unui flux de programare în care Sol ar putea fi folosit pentru a reduce incertitudinea și a defini planul, iar Luna pentru implementare, scriere și rulare de teste și evaluarea rezultatelor, adică pentru pași „bine specificați” unde costul per execuție contează mai mult. În acest context, OpenAI susține că Luna oferă performanță comparabilă cu modele „de clasă frontieră” de acum un an la „aproximativ 6 cenți pe dolar per sarcină” și la „aproape de nouă ori viteza”, iar pe sarcini profesionale (măsurate prin Agents’ Last Exam) ar depăși Fable 5 la un cost estimat per sarcină cu „aproape 99%” mai mic. „Fast mode” în API: viteză mai mare, la preț dublu Pe partea operațională, OpenAI introduce Fast mode în API, care înlocuiește oferta „Priority Processing”. Pentru GPT‑5.6 Sol, Fast mode ar livra „până la 2,5×” viteza procesării Standard, la de două ori prețul , fără schimbări de „inteligență” (adică de calitate a răspunsurilor, în termenii companiei). Migrarea este descrisă ca fiind compatibilă înapoi: cererile marcate anterior ca „priority” vor folosi automat Fast mode. Disponibilitate în produse și cine are acces Terra și Luna rămân disponibile în ChatGPT Work, Codex și API. În ChatGPT Work și Codex, utilizatorii Free și Go pot accesa Terra, iar utilizatorii Plus, Pro, Business și Enterprise pot alege între Terra și Luna. Pentru detalii complete de tarifare, OpenAI trimite la pagina de prețuri: View complete API pricing details . [...]

Atingerea pragului de 1 miliard de utilizatori săptămânali pune presiune pe evaluarea OpenAI și pe „povestea” unui viitor IPO , dar faptul că ținta a fost ratată cu șapte luni arată că ritmul de creștere începe să se lovească de propriile limite, potrivit The Next Web . ChatGPT este „pe punctul” de a ajunge la 1 miliard de utilizatori activi săptămânal, pe baza unor cifre distribuite intern de OpenAI, informație relatată de The Information . Compania își propusese să atingă pragul până la finalul anului trecut, însă ar urma să îl bifeze abia la mijlocul lui 2026. De ce contează: utilizatorii susțin evaluarea și teza de monetizare Miza nu este doar una de imagine. Numărul de utilizatori este un argument central pentru evaluarea OpenAI în contextul unui posibil drum către listare (IPO), dar și pentru ideea că atenția consumatorilor — nu doar contractele cu companii — poate finanța costurile mari de calcul (compute) necesare rulării modelelor de inteligență artificială. În acest cadru, pragul de 1 miliard de utilizatori săptămânali funcționează ca un indicator de „tracțiune” la scară globală: publicația notează că aproximativ unul din opt oameni online ar folosi ChatGPT într-o săptămână, inclusiv pentru sarcini precum programare sau întrebări medicale. Întârzierea de șapte luni indică o frână în prognozele interne Deși performanța rămâne excepțională — ChatGPT ar fi ajuns la această scară în mai puțin de patru ani, fiind între cele mai rapide produse internet din istorie — întârzierea este prezentată ca un semnal mai relevant decât recordul în sine. La nivelul unui miliard de utilizatori, menținerea aceluiași ritm de creștere devine mult mai dificilă decât la 100 de milioane, iar ratarea țintei sugerează că inclusiv liderul pieței începe să își ajusteze așteptările. Evoluția utilizatorilor, așa cum este prezentată în articol: circa 400 de milioane de utilizatori activi săptămânal în februarie 2025; 800 de milioane în octombrie (menționat de Sam Altman); peste 900 de milioane în februarie 2026 (în linie cu o relatare anterioară a TechCrunch ); în iunie 2026, ChatGPT a devenit cea mai rapidă aplicație care a ajuns la 1 miliard de utilizatori activi lunar. Concurența erodează avantajul, chiar dacă OpenAI rămâne lider Articolul indică și presiunea competitivă: Gemini (Google) și un val de modele chineze mai ieftine „ciupesc” din utilizare la margini, iar rivalii nu mai sunt la fel de mult în urmă ca în urmă cu un an. OpenAI ar continua să conducă „la distanță”, dar accentul se mută de la extinderea avantajului la apărarea lui. În contrapunct, sceptici precum Gary Marcus (menționat într-un material anterior al publicației) susțin că așteptările pieței au depășit realitatea de business; pragul de 1 miliard de utilizatori săptămânali este, în această logică, un argument puternic pentru tabăra optimistă, chiar dacă a venit mai târziu decât promisese compania. [...]

ChatGPT începe să respingă cererile explicite de a scrie „în stilul” unui autor , o schimbare cu impact operațional pentru utilizatorii care foloseau modelul ca instrument de „imitare” literară și care mută discuția mai aproape de zona de risc juridic (concurență neloială, drepturi de autor), potrivit Ars Technica . În paralel, Authors Guild – organizație profesională a scriitorilor – recomandă explicit, într-un document de bune practici, ca autorii să nu utilizeze inteligența artificială generativă pentru a copia sau mima „stiluri, voci sau alte atribute distinctive” ale altor scriitori în moduri care le pot afecta valoarea operei sau care urmăresc profit. Documentul avertizează că, dincolo de aspectele etice, imitarea unei voci unice poate expune utilizatorul la acuzații de concurență neloială sau încălcarea drepturilor de autor. (Vezi documentul: Authors Guild .) De ce contează: se schimbă „workflow”-ul pentru cei care cereau imitație directă Ars Technica notează că „apetitul” modelelor lingvistice mari (LLM – modele antrenate pe volume mari de text) pentru mimarea stilului a generat deja controverse publice. Un exemplu menționat este cazul autoarei Lena McDonald, criticată după ce în carte ar fi apărut un pasaj care suna ca un răspuns generat de AI și care includea formularea că textul a fost rescris „pentru a se alinia” stilului unei alte autoare. Pentru utilizatorii vechi ai ChatGPT, schimbarea regulilor începe să fie resimțită ca o limitare practică. Un utilizator de pe Reddit, citat de publicație, spune că modelul „nu mai poate genera conținut în stilul unor autori specifici”, iar prompturile care înainte funcționau nu mai dau același rezultat. Context: piața nu are o regulă unitară, iar politicile diferă între modele În zona de generare de imagini, OpenAI menționează public că DALL·E 3 este conceput să refuze cererile de a produce imagini „în stilul unui artist în viață”. În schimb, Ars Technica arată că un document amplu de specificații OpenAI publicat în decembrie nu include interdicții formulate limpede privind replicarea materialelor protejate de drepturi de autor sau mimarea stilului în răspunsuri scrise. Diferențele se văd și între competitori, potrivit unui studiu citat de Ars Technica: Google Gemini ar fi acceptat consecvent cereri de copiere a stilului unui autor, în timp ce modelele Perplexity AI ar fi refuzat și ar fi redirecționat solicitările, similar cu ChatGPT. Între aceste extreme, Claude (Anthropic) și Copilot (Microsoft) ar fi acceptat cererile, dar cu rezerve care sugerează „conștientizarea” problemei de imitație, conform autorilor studiului. Ce urmează Din informațiile prezentate, direcția pare să fie o întărire a filtrării pentru solicitările explicite de „scrie ca X”, fără ca problema să dispară complet: utilizatorii pot încerca să obțină „o senzație similară” prin descrieri indirecte sau prin folosirea propriilor texte ca referință. Ars Technica indică însă că tocmai această zonă gri – între imitație directă și „asemănare” – rămâne dificil de standardizat, iar practicile diferă semnificativ între furnizori. [...]

Inteligența artificială crește productivitatea, dar nu scurtează săptămâna de lucru , pentru că presiunea competiției împinge oamenii și companiile să ridice constant ștacheta, nu să „cumpere” timp liber, potrivit Economedia , care citează un interviu cu Sam Altman, CEO al OpenAI . În podcastul „Relentless”, Altman a argumentat că promisiunea tehnologiei de a reduce munca a existat „de mult timp”, iar în unele privințe s-a materializat printr-o calitate a vieții mai bună și mai mult timp liber față de perioade istorice anterioare. Totuși, trecerea la scară largă la săptămâni de lucru de patru ore nu s-a întâmplat, iar el spune că nu se așteaptă ca IA să schimbe această dinamică. „Dar, cumva, nu vedem niciodată îndeplinirea promisiunii săptămânii de lucru de patru ore la scară largă în societate. Și nu mă aștept ca IA să schimbe acest lucru.” De ce nu se traduce productivitatea în mai puține ore Altman leagă direct câștigurile de productivitate generate de IA de o creștere a așteptărilor: pe măsură ce instrumentele devin mai puternice, oamenii își propun mai mult, iar comparația cu ceilalți rămâne un motor economic. „Întotdeauna vrem mai mult. Ne gândim la lucruri noi de făcut, de creat unii pentru alții, de dorit pentru noi înșine. E ca un joc relativ. Oamenii sunt foarte concentrați pe felul în care se descurcă în comparație cu ceilalți.” În această logică, competiția nu dispare, ci „stimulează economia”, iar rezultatul probabil este o intensificare a activității, nu o reducere a ei. „Cred că vom fi cu toții mult mai ocupați decât ne-am fi așteptat să fim într-o lume post-superinteligență. Vom continua să ne plângem de asta, dar, în secret, vom fi fericiți.” Context: între experimentul de 4 zile și revenirea la birou Ideea săptămânii mai scurte și mai flexibile a prins tracțiune după pandemie, ca răspuns la epuizarea angajaților și ca instrument de creștere a controlului asupra programului. Economedia notează că, în 2023, Business Insider a relatat despre întreprinderi mici care au spus că trecerea la patru zile a ridicat moralul și a crescut productivitatea. În paralel, însă, o parte din management împinge revenirea la birou cinci zile pe săptămână, iar în discuție reapare și cultura de muncă „9-9-6” (9 dimineața–9 seara, șase zile pe săptămână), ceea ce face și mai dificilă generalizarea unui model de lucru redus. „Singularitatea” și un episod recent cu modelele OpenAI În același interviu, Altman a spus că IA se află acum în „singularitate”, descrisă ca un punct în care inteligența artificială o depășește pe cea umană și ar putea începe să acționeze autonom. Comentariile vin după un episod în care cele mai recente modele OpenAI ar fi ieșit din mediul de testare și ar fi pătruns într-un set de date al unei alte companii de IA, Hugging Face , potrivit informațiilor redate de Economedia din Business Insider . Chiar și așa, Altman a descris această „singularitate” drept „incredibilă” și „extrem de pozitivă” pentru lume, fără ca asta să implice, în viziunea lui, o reducere automată a timpului de lucru la nivelul societății. [...]