Știri
Știri din categoria Inteligență artificială

xAI ar folosi doar 11% dintr-o flotă de 550.000 de GPU-uri NVIDIA, potrivit Wccftech, care citează un raport despre nivelul de utilizare a infrastructurii de calcul pentru inteligență artificială (IA).
Publicația notează că, în timp ce xAI ar valorifica puțin peste 10% din capacitatea instalată, rivali precum Meta și Google ar ajunge la rate de utilizare de 43–46% din propriile flote de GPU-uri. Diferența este importantă deoarece GPU-urile (procesoare grafice folosite masiv la antrenarea și rularea modelelor IA) sunt scumpe, iar eficiența utilizării lor influențează direct costurile și viteza de dezvoltare.
În articol, Wccftech pune această performanță mai slabă pe seama „optimizărilor lipsite de rezultate” la nivelul „stivei software” pentru IA (ansamblul de programe, biblioteci și instrumente care coordonează antrenarea și rularea modelelor pe hardware). Cu alte cuvinte, nu doar numărul de cipuri contează, ci și cât de bine este folosită infrastructura prin software.
„xAI este, potrivit relatărilor, capabilă să utilizeze doar puțin peste 10% din întreaga sa flotă de GPU-uri NVIDIA.”
Wccftech indică drept sursă primară un material al publicației The Information, care ar fi raportat că xAI, compania lui Elon Musk, utilizează doar o mică parte din capacitatea totală de GPU instalată. În același context, articolul amintește că xAI dezvoltă „Gorq” și alte componente bazate pe IA (formulare preluată din textul sursă).
Mesajul mai larg este că blocajele din „stiva software” nu ar fi o problemă izolată, ci una întâlnită în industrie. În practică, astfel de blocaje pot apărea din configurarea și programarea sarcinilor de lucru, comunicarea între servere, gestionarea memoriei sau din modul în care sunt integrate bibliotecile de antrenare.
În forma prezentată de Wccftech, comparația dintre companii se reduce la câteva cifre-cheie:
Dacă aceste estimări se confirmă, implicația este că xAI ar putea avea costuri mai mari per unitate de progres (de exemplu, per model antrenat sau per îmbunătățire de performanță), în timp ce competitorii ar obține mai multă „muncă utilă” din aceeași clasă de resurse.
În acest stadiu, articolul nu oferă detalii despre metodologia exactă de măsurare a utilizării sau despre intervalul de timp analizat, iar formulările rămân la nivel de „potrivit relatărilor”.
Recomandate

Google reduce la jumătate costul inițial pentru Gemini 3.7 Flash și mizează pe agenți AI mai ieftini în producție , potrivit Google . Noul model din seria „Flash”, orientat spre programare și „agenți” (sisteme care pot planifica pași și apela instrumente), vine la trei săptămâni după Gemini 3.6 Flash și este poziționat ca „model de lucru” („workhorse”) pentru fluxuri complexe, cu îmbunătățiri de performanță și un preț introductiv mai mic. Preț: tarif introductiv până la final de an Google spune că Gemini 3.7 Flash este disponibil „până la finalul anului” la un preț introductiv de: 0,75 dolari (aprox. 3,4 lei) / 1 milion de tokeni de intrare 3,75 dolari (aprox. 17,1 lei) / 1 milion de tokeni de ieșire Compania afirmă că acest nivel este „jumătate din costul original” al lui 3.6 Flash per milion de tokeni și îl leagă direct de posibilitatea de a scala agenți „gata de producție” mai eficient din punct de vedere al costurilor. Ce câștigă dezvoltatorii: mai multă acuratețe „din prima” și mai puține reluări În zona de inginerie software, Google indică îmbunătățiri pe sarcini precum depanare și rezolvare de „issue”-uri, plus o acuratețe mai bună a codului la prima încercare și rezultate mai bune la generarea de cod „production-ready” (cod suficient de robust pentru utilizare în produse). În benchmark-uri, compania menționează: FrontierCode 1.1 Main: 43,6% pentru 3.7 Flash vs 34,4% pentru 3.6 Flash (detalii la FrontierCode 1.1 Main ) DeepSWE v1.1: 65,3% vs 49,0% (detalii la DeepSWE v1.1 ) Pentru web development, Google afirmă că modelul poate genera „layout-uri” mai funcționale și aplicații mai complete cu mai puține prompturi și că respectă mai bine un input de referință (captură de ecran, imagine sau sistem de design). Pe WebDev Arena, scorul Elo este 1.588 vs 1.538 pentru 3.6 Flash (clasament: WebDev Arena ). Implicații pentru business: performanță mai bună pe documente și automatizări Google susține că, în domenii „dense în cunoștințe” precum finanțe, drept și bioștiințe, 3.7 Flash îmbunătățește raționamentul și acuratețea. Ca exemple, compania citează: GDP.pdf benchmark: 34,0% vs 22,0% (evaluare pentru procesarea documentelor complexe) AutomationBench: 30,4% vs 17,0%, pentru finalizarea fluxurilor de lucru de business (detalii la AutomationBench ) Pe partea operațională, Google leagă aceste îmbunătățiri de o execuție „mai disciplinată”, cu mai puțină supraveghere manuală și mai puține încercări repetate în fluxurile de inginerie. Unde va fi disponibil: de la API la Gemini Spark Modelul este integrat și în Gemini Spark, agentul personal „24/7” din aplicația Gemini, disponibil pentru abonații Google AI Pro și Ultra în peste 160 de țări (listă: Google Support ). Google spune că Spark va folosi 3.7 Flash „începând de astăzi”, cu accent pe lucru cu aplicațiile Google Workspace și sarcini precum consolidarea fișierelor, redactarea de e-mailuri și actualizarea documentelor de status. Pentru dezvoltatori, accesul este indicat prin Google AI Studio și Gemini API (link direct: Google AI Studio ), iar pentru companii prin Gemini Enterprise Agent Platform și aplicația Gemini Enterprise. Siguranță: actualizări pentru CBRN și ofensivă cibernetică Google afirmă că Gemini 3.7 Flash este livrat cu „safeguards” actualizate împotriva abuzurilor în zona Chemical, Biological, Radiological, and Nuclear (CBRN) și ofensivă cibernetică, în linie cu cadrul Frontier Safety (detalii: Frontier Safety ) și abordarea privind bio-reziliența (detalii: our approach to bioresilience ). Pentru informații tehnice, compania trimite la „model card” (fișa modelului): Gemini 3.7 Flash model card . Într-un material separat, publicația CNMO relatează aceleași rezultate de benchmark și menționează o posibilă majorare de preț de la 1 ianuarie 2027, însă această informație nu apare în postarea Google citată mai sus. [...]

Google accelerează ciclul de actualizare al modelelor „Flash”, iar pentru dezvoltatori asta înseamnă schimbări rapide de performanță și de preț : potrivit Ars Technica , compania lansează Gemini 3.7 Flash ca înlocuitor pentru 3.6 Flash, la doar trei săptămâni după versiunea anterioară, mizând pe optimizări „de bază”, feedback de la dezvoltatori și un „preț introductiv” mai mic pentru a contracara modelele concurente mai ieftine. Gemini 3.7 Flash este prezentat ca modelul „de lucru” (workhorse) din portofoliu, cu îmbunătățiri în special la programare și la capabilități „agentice” (adică sarcini în care modelul execută pași multipli, în mod semi-autonom, pentru a atinge un obiectiv). Google nu lansează însă mult-așteptatul Gemini 3.5 Pro, pe care îl poziționează drept vârf de gamă. Ce se schimbă în performanță, conform benchmarkurilor citate Tulsee Doshi, Senior Director la Google, susține că noul model este „vizibil” mai bun la programare decât 3.6 Flash, iar Ars Technica notează câteva creșteri punctuale în testele publice: FrontierCode 1.1 Main : de la 34,4% la 43,6% DeepSWE v1.1 : de la 49% la 65,3% WebDev Arena : de la 1.538 la 1.588 Pentru utilizări orientate spre „a ști lucruri” și procesare de conținut, publicația menționează și: GDP.pdf (procesarea documentelor complexe): de la 22% la 34% AutomationBench (fluxuri de lucru uzuale în business): de la 17% la 30,4% De ce contează: ritmul de lansare și presiunea pe costuri Dincolo de creșterile din benchmarkuri, întrebarea ridicată este dacă diferențele sunt suficient de mari pentru a justifica o nouă versiune la doar trei săptămâni. Ars Technica sugerează că mișcarea poate ține și de nevoia Google de a menține percepția unui progres constant în AI, mai ales într-un context în care ritmul pare să fi încetinit în 2026. În paralel, Google încearcă să răspundă competiției pe preț , printr-un „preț introductiv” mai mic pentru 3.7 Flash (articolul nu oferă valori concrete). Context: întârzierea Gemini 3.5 Pro Publicația amintește că, la conferința I/O din mai, Google a promis lansarea modelului „flagship” Gemini 3.5 Pro în iunie, însă acest lucru nu s-a întâmplat. În acest tablou, 3.7 Flash pare să acopere nevoia de noutate și îmbunătățiri incrementale, în timp ce produsul de vârf rămâne nelivrat la termen. [...]

O plângere penală depusă în Germania împotriva ochelarilor Meta AI ridică riscul unor restricții de vânzare și utilizare , pe fondul acuzațiilor că dispozitivele ar permite filmarea „pe ascuns” și ar încălca legislația locală privind confidențialitatea, potrivit G4Media . O organizație non-profit cu sediul în Berlin a depus plângerea, susținând că ochelarii inteligenți ai Meta încalcă normele stricte ale Germaniei privind protecția vieții private și că ar trebui interziși. În ultimele luni, preocupările au crescut după relatări potrivit cărora unele persoane ar fi fost filmate fără consimțământ sau ar fi fost înregistrate imagini intime fără ca acestea să știe că ar putea fi vizionate de contractanți ai Meta. Plângerea a fost depusă de HateAid , care afirmă că vânzarea ochelarilor inteligenți Meta în Germania ar constitui o infracțiune, deoarece dispozitivele permit utilizatorilor să filmeze pe ascuns alte persoane. Documentul invocă încălcarea Legii germane privind telecomunicațiile, serviciile digitale și protecția datelor. Cine este vizat și ce se cere Plângerea este îndreptată împotriva: Meta; Ray-Ban și Oakley, mărci de ochelari care au colaborat cu Meta la proiectarea dispozitivului; mai multor comercianți cu amănuntul (fără a fi detaliați în material). HateAid susține că ochelarii ar trebui comercializați doar dacă sunt „clar identificabili” și cere restricții privind înregistrarea în anumite spații, similare celor aplicate camerelor de bord sau camerelor corporale. Poziția Meta și miza de reglementare Meta spune că ochelarii inteligenți au fost aprobați de autoritatea germană de reglementare BNetzA în 2022. Purtătorul de cuvânt al companiei, Matthew Pollard, a afirmat că dispozitivele au fost concepute cu măsuri de protecție a vieții private, inclusiv o lumină LED care se aprinde la înregistrare și o tehnologie care ar împiedica manipularea acestei lumini. În paralel, autoritățile europene de reglementare în domeniul confidențialității au comandat un raport despre ochelarii inteligenți, care ar urma să fie finalizat în această vară, ceea ce poate influența cadrul de utilizare și vânzare al acestor dispozitive în UE. [...]
Google mută valoarea din hardware în abonamente și „memorie” AI , iar Pixel riscă să devină în primul rând poarta de acces către Gemini, nu produsul-vedetă în sine, potrivit Mobilissimo , după un workshop Google organizat la Berlin despre ecosistemul Pixel și integrarea tot mai strânsă a AI-ului în experiența de utilizare. Miza operațională și comercială este că Google încearcă să transforme Gemini dintr-un chatbot „bun la întrebări generale” într-un asistent care păstrează context despre utilizator (memorie, preferințe, aplicații conectate), iar accesul la capabilități și „libertatea de utilizare” este împachetat tot mai explicit în trepte de abonament. „Personal Intelligence”: Gemini cu memorie și aplicații conectate În demonstrațiile de la Berlin, Google a insistat pe meniul „Personal Intelligence” din Gemini, construit pe trei elemente: memoria conversațiilor, aplicațiile conectate și instrucțiunile personale. Concret, Gemini poate folosi informații din servicii precum Gmail, Photos, YouTube sau Search pentru răspunsuri adaptate, iar conexiunile pot fi activate sau dezactivate individual. Din perspectiva utilizării, diferența nu mai este doar calitatea răspunsului, ci faptul că asistentul „știe” ce ai făcut și ce ai discutat anterior, ceea ce îl face mai greu de înlocuit, dar ridică și o întrebare de confort pentru utilizatori: cât context sunt dispuși să ofere unui AI. „Creator DNA”: profilarea stilului de lucru, ca instrument de producție O altă demonstrație prezentată a fost „Gemini Notebook Script Writer”, unde utilizatorul încarcă într-un notebook materiale relevante pentru activitatea sa (videoclipuri, transcripturi, postări, comentarii, capturi din feed, inclusiv date despre performanță). Gemini le analizează și generează un profil de tip „Creator DNA” (stil de scris, structură, ritm, tip de exemple, adresare către comunitate), care poate fi salvat și folosit ulterior pentru scenarii, formate noi sau brief-uri, inclusiv pentru colaborări plătite. Mobilissimo leagă această direcție de evoluția NotebookLM, care ar fi depășit rolul de simplu instrument de rezumare, prin integrarea mai strânsă cu Gemini. Abonamentele Google: „cât Gemini primești” devine produsul În prezentarea Google, planurile Free, Google AI Plus , Pro și Ultra au fost diferențiate nu doar prin acces la modele, ci prin limite de utilizare, fereastra de context (cantitatea de informație pe care AI o poate „ține minte” într-o sesiune), generare video, credite pentru Flow și Whisk și spațiu de stocare. Conform slide-ului descris: Free: context 32K și 15 GB stocare Google AI Plus: 4,99 euro/lună (aprox. 25 lei), context 128K, limite de două ori mai mari decât Free, 200 credite/lună pentru Flow și Whisk, 400 GB AI Pro: 21,99 euro (aprox. 110 lei), context de 1 milion de tokeni, limite de patru ori mai mari, 1.000 credite, 5 TB Ultra: de la 99,99 euro (aprox. 500 lei), context de 1 milion de tokeni, limite între 5 și 20 de ori mai mari, 10.000–25.000 credite, 20 TB Interpretarea editorială din material este că Google împinge abonamentele AI într-o logică similară cu stocarea în cloud sau streaming: nivelul gratuit „te introduce”, iar treptele superioare cumpără în principal volum și continuitate de utilizare. Unde mai intră Pixel: hardware de referință pentru ambițiile AI Workshopul a fost centrat pe Pixel tocmai pentru că telefonul rămâne locul în care se întâlnesc camera, Android, aplicațiile și AI-ul. Mobilissimo notează că direcția era vizibilă și la Pixel 10, cu Gemini „adânc legat” de experiența software, iar acum Pixel este prezentat mai degrabă ca hardware de referință pentru strategia AI a Google. Consecința practică pentru piața de telefoane este o schimbare de criteriu: dacă diferențele majore între generații vin din software, „memorie personală” și servicii AI, întrebarea devine cât mai valorează upgrade-ul hardware în sine. În această ecuație, avantajul Pixel ar putea să nu mai fie doar „primește primul funcții”, ci că devine accesul cel mai natural la un Gemini care cunoaște deja munca, fotografiile, preferințele și modul de comunicare al utilizatorului. [...]

Aplicația Gemini a Google a depășit pragul de 1 miliard de utilizatori activi lunar, un nivel care o pune în aceeași ligă de utilizare cu ChatGPT și întărește miza economică a integrării AI în produsele companiei, potrivit TechCrunch . Anunțul a fost făcut de CEO-ul Sundar Pichai pe X, care a descris Gemini drept unul dintre produsele cu cea mai rapidă creștere din portofoliul Google și al 14-lea produs al companiei care atinge „clubul” de 1 miliard. Publicația notează că OpenAI a ajuns la 1 miliard de utilizatori activi lunar pentru ChatGPT în iunie, ceea ce face ca ritmul Gemini să fie relevant în competiția directă dintre cele două platforme. Ce include (și ce nu include) cifra de 1 miliard Google a integrat treptat Gemini în mai multe produse – de la Search și Workspace la Android și aplicația separată. Totuși, cifra comunicată acum se referă strict la aplicația Gemini și nu include utilizatorii AI din alte canale ale companiei. În paralel, Google indică faptul că „AI Mode” din Search a depășit, la rândul său, 1 miliard de utilizatori activi lunar la nivel global, dar acesta este un indicator distinct față de utilizarea aplicației Gemini. Cum folosesc utilizatorii Gemini și ce semnale operaționale transmite Google Compania a oferit și câteva date despre comportamentul de utilizare, care sugerează o orientare către interacțiuni mai „grele” din punct de vedere tehnic (voce, generare de imagini): 63% dintre utilizatorii Gemini folosesc funcția de voce pentru a vorbi direct cu asistentul; Gemini generează peste 150 de milioane de imagini pe zi, potrivit Google; pe iOS, Google spune că are peste 100 de milioane de utilizatori activi. Google a menționat și lansarea de modele și funcții noi, inclusiv „Gemini 3.5 Flash”, despre care compania afirmă că este conceput pentru a îmbunătăți programarea și sarcini autonome de tip „agent AI” (adică sisteme care pot executa pași multipli în numele utilizatorului). Context: după rezultate și înainte de „ Made by Google ” Pragul de 1 miliard vine la scurt timp după conferința de rezultate pentru trimestrul al doilea din 2026, unde Google a spus că depășise 950 de milioane de utilizatori activi lunar, iar utilizatorii activi zilnic s-ar fi triplat în ultimul an. Anunțul este plasat și înaintea evenimentului „Made by Google”, unde este de așteptat ca Google să lanseze funcții noi bazate pe Gemini pe dispozitivele Pixel. [...]

Aplicația Gemini a depășit pragul de 1 miliard de utilizatori lunari , consolidându-și poziția de produs cu cea mai rapidă creștere din istoria Google , potrivit Google Health . Pentru piață, miza nu este doar dimensiunea audienței, ci faptul că utilizarea se mută accelerat spre interacțiuni vocale, funcții multimodale (cameră, partajare de ecran) și automatizări în aplicații — adică spre scenarii care pot crește dependența de asistent și pot extinde utilizarea în activități de zi cu zi. Cum se schimbă utilizarea: voce, cameră și atașamente Datele prezentate indică o orientare puternică spre interacțiunea vocală și spre rezolvarea de probleme „în timp real”: 63% dintre utilizatori vorbesc direct cu Gemini , inclusiv un număr mai mare de utilizatori „doar voce”. Părinții ocupați sunt cu 43% mai predispuși să folosească vocea pentru sarcini cotidiene. 1 din 5 interacțiuni Gemini Live depășește vocea: utilizatorii folosesc fluxuri video live și partajare de ecran pentru rezolvare de probleme în timp real, popular mai ales la pasionații de bricolaj și la studenți. În zona educației, 38% dintre solicitările legate de școală includ un atașament , semn că utilizarea se bazează frecvent pe documente și materiale încărcate. Funcții cu impact operațional: creație de conținut și automatizări în aplicații Google indică două direcții care pot conta direct pentru productivitate și pentru utilizarea în mediul de afaceri: Gemini generează peste 150 de milioane de imagini pe zi , iar compania susține că funcțiile de creație (imagini, video și audio „într-un singur loc”) sunt folosite de micile afaceri pentru materiale precum cele de marketing. Pe Android, Gemini poate automatiza acțiuni în peste 40 de aplicații populare , inclusiv pentru sarcini precum rezervări sau comenzi. iOS și macOS: bază mare de utilizatori, intensitate mai ridicată pe Mac Pe ecosistemul Apple, Google raportează peste 100 de milioane de utilizatori activi pe iOS , iar utilizatorii „power” de macOS ar formula solicitări („prompturi”) de circa două ori mai des decât pe alte platforme. Ce urmează, în viziunea Google Compania spune că își propune să construiască „pentru următorul miliard” și să facă Gemini „cel mai personal, proactiv și puternic asistent”. În practică, datele publicate sugerează că direcția este extinderea utilizării dincolo de chat: spre voce, multimodal și automatizări, adică spre integrare mai profundă în fluxurile zilnice de lucru și viață. [...]