Știri
Știri din categoria Inteligență artificială

Google își mută accentul pe „agenți” și automatizare, cu modele Gemini mai eficiente și instrumente care pot acționa în conturile utilizatorilor, potrivit Google AI Blog, într-un rezumat al principalelor anunțuri din iulie 2026. Miza operațională este reducerea costurilor și a timpilor de răspuns pentru aplicații AI rulate în producție, dar și extinderea capabilităților către sarcini concrete, inclusiv în lumea fizică (robotică) și pe web.
Google spune că a lansat trei modele noi din familia Gemini – Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber – orientate către dezvoltatori și companii care construiesc „agenți” AI (sisteme care pot planifica și executa sarcini). Argumentul central este eficiența: mai bună utilizare a „tokenilor” (unități de text procesate de model), latență mai mică și performanță mai predictibilă, pentru a putea scala fluxuri de lucru „agentice” în producție. Detaliile sunt prezentate în materialul dedicat despre modele: Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber.
O schimbare cu impact direct asupra modului de utilizare este extinderea Gemini Spark către mai mulți utilizatori la nivel global și adăugarea unei funcții prin care, cu permisiunea utilizatorului, Spark poate folosi conturi autentificate și parole salvate pentru a rezolva „comisioane” pe web (de exemplu, programarea unor vizionări pentru apartamente sau căutarea opțiunilor de zbor și inițierea rezervării). Google descrie aceste actualizări aici: Gemini Spark.
În paralel, compania anunță că extinde conectarea aplicațiilor la Search, astfel încât utilizatorii să poată lega în mod securizat servicii uzuale (exemplul menționat este YouTube Music) și să interacționeze cu ele direct în „AI Mode”. Contextul este prezentat în: Connected apps.
Pe zona de automatizare în lumea fizică, Google anunță Gemini Robotics ER 2, pe care îl numește cel mai capabil model de „embodied reasoning” (raționament întrupat) de până acum – adică un model proiectat să lege „inteligența” digitală de percepția și acțiunea în mediul real. Conform descrierii, ER 2 ar permite sistemelor să converseze natural, să înțeleagă mediul și să ducă la capăt sarcini complexe, în mai mulți pași. Detalii: Gemini Robotics ER 2.
În ecosistemul Google, compania poziționează „Gemini Notebook” ca produs de sine stătător (același cu NotebookLM), dar extins „în ecosistem”, inclusiv în aplicația Gemini și în Google Search, și actualizat cu un „computer cloud securizat”. Prezentarea este aici: Gemini Notebook.
Pentru clienții Google Cloud, Google spune că a făcut disponibil în regim general AlphaEvolve, un agent de optimizare a codului „alimentat de Gemini”, pe Gemini Enterprise Agent Platform. Logica de utilizare: utilizatorul oferă un algoritm de bază și obiectivele, iar sistemul caută soluții mai bune și returnează cod optimizat, „ușor de înțeles” pentru oameni. Detalii: AlphaEvolve pe Google Cloud.
În același rezumat, Google mai indică:
Separat, fondatorul Google DeepMind, Demis Hassabis, își prezintă viziunea într-un material publicat pe LinkedIn: Demis Hassabis.
Pentru piață, mesajul principal al pachetului de anunțuri este că Google împinge AI-ul din zona de asistență conversațională către sisteme mai eficiente și mai „executive” (agenți), cu implicații directe pentru companii: costuri de rulare, timpi de răspuns, integrare cu aplicații și, în unele cazuri, automatizare care poate opera efectiv în conturile utilizatorilor – ceea ce ridică, inevitabil, miza pe controlul permisiunilor și securitate, chiar dacă rezumatul nu intră în detalii de reglementare.
Recomandate

Google își reorganizează conducerea AI pentru a accelera dezvoltarea Gemini și cercetarea de frontieră , într-o mișcare care mută responsabilitățile operaționale de la Demis Hassabis către Koray Kavukcuoglu și repoziționează rolurile la nivel de Alphabet, potrivit Google Blog . Schimbarea are o miză operațională directă: Sundar Pichai spune că Google vrea să „accelereze” execuția pe „frontiera AI”, în timp ce compania își asumă și obiectivul de a influența direcția AGI (inteligență artificială generală). În același mesaj intern, Pichai indică cererea ridicată pentru modelele Gemini în rândul dezvoltatorilor și companiilor și notează că aplicația Gemini a ajuns la „peste 950 de milioane” de utilizatori lunari. Ce se schimbă în Google DeepMind și la nivel de Alphabet Pichai anunță că Demis Hassabis va deveni președinte (Chair) al Google DeepMind și Chief Scientist al Alphabet, păstrând în același timp conducerea Isomorphic Labs . În paralel, Koray Kavukcuoglu (în prezent CTO al Google DeepMind și Chief AI Architect) este promovat SVP (Senior Vice President) al Google DeepMind și va raporta direct către Pichai. În noua structură, Koray va coordona: dezvoltarea modelelor Gemini; cercetarea „Frontier AI” (cercetare de vârf, la limita capabilităților actuale); echipele aplicației Gemini și cele pentru dezvoltatori. Hassabis spune că renunță la responsabilitățile operaționale de zi cu zi pentru a se concentra pe „imaginea de ansamblu” și pe influențarea pașilor următori în direcția AGI. În mesajul către angajați, el menționează și că va „înclina” mai mult către Isomorphic, cu accent pe aplicații în sănătate. Context: presiune pe viteză și produse, nu doar pe cercetare În mesajul său, Pichai enumeră câteva repere recente din portofoliul Google DeepMind: „Flash” este „la mare căutare”, modelul „Cyber” este „live”, iar modelele Gemma au depășit „900 de milioane” de descărcări. Totodată, Hassabis afirmă că echipa lucrează la „noi modele, inclusiv Gemini 4”. Din perspectiva operațională, reorganizarea separă mai clar: rolul de strategie și influență la nivel de Alphabet (Hassabis, ca Chief Scientist); rolul de execuție și livrare a produselor și modelelor (Koray, ca lider al Google DeepMind). Plecarea lui Jeff Dean și un nou vehicul independent Separat, Pichai anunță că Jeff Dean și Sanjay Ghemawat lansează o „ public benefit corporation ” (o companie cu obiectiv public declarat, pe lângă cel comercial) independentă, pentru a accelera descoperiri în învățare automată, știință și inginerie. Google va rămâne „investitor fondator” și partener de cloud și va colabora cu noua entitate pe un cadru de cercetare pentru sisteme de învățare automată și infrastructură aferentă. Google nu oferă în mesaj detalii financiare despre investiție sau despre structura parteneriatului, iar calendarul implementării schimbărilor nu este precizat. [...]

Google reduce la jumătate costul inițial pentru Gemini 3.7 Flash și mizează pe agenți AI mai ieftini în producție , potrivit Google . Noul model din seria „Flash”, orientat spre programare și „agenți” (sisteme care pot planifica pași și apela instrumente), vine la trei săptămâni după Gemini 3.6 Flash și este poziționat ca „model de lucru” („workhorse”) pentru fluxuri complexe, cu îmbunătățiri de performanță și un preț introductiv mai mic. Preț: tarif introductiv până la final de an Google spune că Gemini 3.7 Flash este disponibil „până la finalul anului” la un preț introductiv de: 0,75 dolari (aprox. 3,4 lei) / 1 milion de tokeni de intrare 3,75 dolari (aprox. 17,1 lei) / 1 milion de tokeni de ieșire Compania afirmă că acest nivel este „jumătate din costul original” al lui 3.6 Flash per milion de tokeni și îl leagă direct de posibilitatea de a scala agenți „gata de producție” mai eficient din punct de vedere al costurilor. Ce câștigă dezvoltatorii: mai multă acuratețe „din prima” și mai puține reluări În zona de inginerie software, Google indică îmbunătățiri pe sarcini precum depanare și rezolvare de „issue”-uri, plus o acuratețe mai bună a codului la prima încercare și rezultate mai bune la generarea de cod „production-ready” (cod suficient de robust pentru utilizare în produse). În benchmark-uri, compania menționează: FrontierCode 1.1 Main: 43,6% pentru 3.7 Flash vs 34,4% pentru 3.6 Flash (detalii la FrontierCode 1.1 Main ) DeepSWE v1.1: 65,3% vs 49,0% (detalii la DeepSWE v1.1 ) Pentru web development, Google afirmă că modelul poate genera „layout-uri” mai funcționale și aplicații mai complete cu mai puține prompturi și că respectă mai bine un input de referință (captură de ecran, imagine sau sistem de design). Pe WebDev Arena, scorul Elo este 1.588 vs 1.538 pentru 3.6 Flash (clasament: WebDev Arena ). Implicații pentru business: performanță mai bună pe documente și automatizări Google susține că, în domenii „dense în cunoștințe” precum finanțe, drept și bioștiințe, 3.7 Flash îmbunătățește raționamentul și acuratețea. Ca exemple, compania citează: GDP.pdf benchmark: 34,0% vs 22,0% (evaluare pentru procesarea documentelor complexe) AutomationBench: 30,4% vs 17,0%, pentru finalizarea fluxurilor de lucru de business (detalii la AutomationBench ) Pe partea operațională, Google leagă aceste îmbunătățiri de o execuție „mai disciplinată”, cu mai puțină supraveghere manuală și mai puține încercări repetate în fluxurile de inginerie. Unde va fi disponibil: de la API la Gemini Spark Modelul este integrat și în Gemini Spark, agentul personal „24/7” din aplicația Gemini, disponibil pentru abonații Google AI Pro și Ultra în peste 160 de țări (listă: Google Support ). Google spune că Spark va folosi 3.7 Flash „începând de astăzi”, cu accent pe lucru cu aplicațiile Google Workspace și sarcini precum consolidarea fișierelor, redactarea de e-mailuri și actualizarea documentelor de status. Pentru dezvoltatori, accesul este indicat prin Google AI Studio și Gemini API (link direct: Google AI Studio ), iar pentru companii prin Gemini Enterprise Agent Platform și aplicația Gemini Enterprise. Siguranță: actualizări pentru CBRN și ofensivă cibernetică Google afirmă că Gemini 3.7 Flash este livrat cu „safeguards” actualizate împotriva abuzurilor în zona Chemical, Biological, Radiological, and Nuclear (CBRN) și ofensivă cibernetică, în linie cu cadrul Frontier Safety (detalii: Frontier Safety ) și abordarea privind bio-reziliența (detalii: our approach to bioresilience ). Pentru informații tehnice, compania trimite la „model card” (fișa modelului): Gemini 3.7 Flash model card . Într-un material separat, publicația CNMO relatează aceleași rezultate de benchmark și menționează o posibilă majorare de preț de la 1 ianuarie 2027, însă această informație nu apare în postarea Google citată mai sus. [...]

Google accelerează ciclul de actualizare al modelelor „Flash”, iar pentru dezvoltatori asta înseamnă schimbări rapide de performanță și de preț : potrivit Ars Technica , compania lansează Gemini 3.7 Flash ca înlocuitor pentru 3.6 Flash, la doar trei săptămâni după versiunea anterioară, mizând pe optimizări „de bază”, feedback de la dezvoltatori și un „preț introductiv” mai mic pentru a contracara modelele concurente mai ieftine. Gemini 3.7 Flash este prezentat ca modelul „de lucru” (workhorse) din portofoliu, cu îmbunătățiri în special la programare și la capabilități „agentice” (adică sarcini în care modelul execută pași multipli, în mod semi-autonom, pentru a atinge un obiectiv). Google nu lansează însă mult-așteptatul Gemini 3.5 Pro, pe care îl poziționează drept vârf de gamă. Ce se schimbă în performanță, conform benchmarkurilor citate Tulsee Doshi, Senior Director la Google, susține că noul model este „vizibil” mai bun la programare decât 3.6 Flash, iar Ars Technica notează câteva creșteri punctuale în testele publice: FrontierCode 1.1 Main : de la 34,4% la 43,6% DeepSWE v1.1 : de la 49% la 65,3% WebDev Arena : de la 1.538 la 1.588 Pentru utilizări orientate spre „a ști lucruri” și procesare de conținut, publicația menționează și: GDP.pdf (procesarea documentelor complexe): de la 22% la 34% AutomationBench (fluxuri de lucru uzuale în business): de la 17% la 30,4% De ce contează: ritmul de lansare și presiunea pe costuri Dincolo de creșterile din benchmarkuri, întrebarea ridicată este dacă diferențele sunt suficient de mari pentru a justifica o nouă versiune la doar trei săptămâni. Ars Technica sugerează că mișcarea poate ține și de nevoia Google de a menține percepția unui progres constant în AI, mai ales într-un context în care ritmul pare să fi încetinit în 2026. În paralel, Google încearcă să răspundă competiției pe preț , printr-un „preț introductiv” mai mic pentru 3.7 Flash (articolul nu oferă valori concrete). Context: întârzierea Gemini 3.5 Pro Publicația amintește că, la conferința I/O din mai, Google a promis lansarea modelului „flagship” Gemini 3.5 Pro în iunie, însă acest lucru nu s-a întâmplat. În acest tablou, 3.7 Flash pare să acopere nevoia de noutate și îmbunătățiri incrementale, în timp ce produsul de vârf rămâne nelivrat la termen. [...]
Google mută valoarea din hardware în abonamente și „memorie” AI , iar Pixel riscă să devină în primul rând poarta de acces către Gemini, nu produsul-vedetă în sine, potrivit Mobilissimo , după un workshop Google organizat la Berlin despre ecosistemul Pixel și integrarea tot mai strânsă a AI-ului în experiența de utilizare. Miza operațională și comercială este că Google încearcă să transforme Gemini dintr-un chatbot „bun la întrebări generale” într-un asistent care păstrează context despre utilizator (memorie, preferințe, aplicații conectate), iar accesul la capabilități și „libertatea de utilizare” este împachetat tot mai explicit în trepte de abonament. „Personal Intelligence”: Gemini cu memorie și aplicații conectate În demonstrațiile de la Berlin, Google a insistat pe meniul „Personal Intelligence” din Gemini, construit pe trei elemente: memoria conversațiilor, aplicațiile conectate și instrucțiunile personale. Concret, Gemini poate folosi informații din servicii precum Gmail, Photos, YouTube sau Search pentru răspunsuri adaptate, iar conexiunile pot fi activate sau dezactivate individual. Din perspectiva utilizării, diferența nu mai este doar calitatea răspunsului, ci faptul că asistentul „știe” ce ai făcut și ce ai discutat anterior, ceea ce îl face mai greu de înlocuit, dar ridică și o întrebare de confort pentru utilizatori: cât context sunt dispuși să ofere unui AI. „Creator DNA”: profilarea stilului de lucru, ca instrument de producție O altă demonstrație prezentată a fost „Gemini Notebook Script Writer”, unde utilizatorul încarcă într-un notebook materiale relevante pentru activitatea sa (videoclipuri, transcripturi, postări, comentarii, capturi din feed, inclusiv date despre performanță). Gemini le analizează și generează un profil de tip „Creator DNA” (stil de scris, structură, ritm, tip de exemple, adresare către comunitate), care poate fi salvat și folosit ulterior pentru scenarii, formate noi sau brief-uri, inclusiv pentru colaborări plătite. Mobilissimo leagă această direcție de evoluția NotebookLM, care ar fi depășit rolul de simplu instrument de rezumare, prin integrarea mai strânsă cu Gemini. Abonamentele Google: „cât Gemini primești” devine produsul În prezentarea Google, planurile Free, Google AI Plus , Pro și Ultra au fost diferențiate nu doar prin acces la modele, ci prin limite de utilizare, fereastra de context (cantitatea de informație pe care AI o poate „ține minte” într-o sesiune), generare video, credite pentru Flow și Whisk și spațiu de stocare. Conform slide-ului descris: Free: context 32K și 15 GB stocare Google AI Plus: 4,99 euro/lună (aprox. 25 lei), context 128K, limite de două ori mai mari decât Free, 200 credite/lună pentru Flow și Whisk, 400 GB AI Pro: 21,99 euro (aprox. 110 lei), context de 1 milion de tokeni, limite de patru ori mai mari, 1.000 credite, 5 TB Ultra: de la 99,99 euro (aprox. 500 lei), context de 1 milion de tokeni, limite între 5 și 20 de ori mai mari, 10.000–25.000 credite, 20 TB Interpretarea editorială din material este că Google împinge abonamentele AI într-o logică similară cu stocarea în cloud sau streaming: nivelul gratuit „te introduce”, iar treptele superioare cumpără în principal volum și continuitate de utilizare. Unde mai intră Pixel: hardware de referință pentru ambițiile AI Workshopul a fost centrat pe Pixel tocmai pentru că telefonul rămâne locul în care se întâlnesc camera, Android, aplicațiile și AI-ul. Mobilissimo notează că direcția era vizibilă și la Pixel 10, cu Gemini „adânc legat” de experiența software, iar acum Pixel este prezentat mai degrabă ca hardware de referință pentru strategia AI a Google. Consecința practică pentru piața de telefoane este o schimbare de criteriu: dacă diferențele majore între generații vin din software, „memorie personală” și servicii AI, întrebarea devine cât mai valorează upgrade-ul hardware în sine. În această ecuație, avantajul Pixel ar putea să nu mai fie doar „primește primul funcții”, ci că devine accesul cel mai natural la un Gemini care cunoaște deja munca, fotografiile, preferințele și modul de comunicare al utilizatorului. [...]

Aplicația Gemini a Google a depășit pragul de 1 miliard de utilizatori activi lunar, un nivel care o pune în aceeași ligă de utilizare cu ChatGPT și întărește miza economică a integrării AI în produsele companiei, potrivit TechCrunch . Anunțul a fost făcut de CEO-ul Sundar Pichai pe X, care a descris Gemini drept unul dintre produsele cu cea mai rapidă creștere din portofoliul Google și al 14-lea produs al companiei care atinge „clubul” de 1 miliard. Publicația notează că OpenAI a ajuns la 1 miliard de utilizatori activi lunar pentru ChatGPT în iunie, ceea ce face ca ritmul Gemini să fie relevant în competiția directă dintre cele două platforme. Ce include (și ce nu include) cifra de 1 miliard Google a integrat treptat Gemini în mai multe produse – de la Search și Workspace la Android și aplicația separată. Totuși, cifra comunicată acum se referă strict la aplicația Gemini și nu include utilizatorii AI din alte canale ale companiei. În paralel, Google indică faptul că „AI Mode” din Search a depășit, la rândul său, 1 miliard de utilizatori activi lunar la nivel global, dar acesta este un indicator distinct față de utilizarea aplicației Gemini. Cum folosesc utilizatorii Gemini și ce semnale operaționale transmite Google Compania a oferit și câteva date despre comportamentul de utilizare, care sugerează o orientare către interacțiuni mai „grele” din punct de vedere tehnic (voce, generare de imagini): 63% dintre utilizatorii Gemini folosesc funcția de voce pentru a vorbi direct cu asistentul; Gemini generează peste 150 de milioane de imagini pe zi, potrivit Google; pe iOS, Google spune că are peste 100 de milioane de utilizatori activi. Google a menționat și lansarea de modele și funcții noi, inclusiv „Gemini 3.5 Flash”, despre care compania afirmă că este conceput pentru a îmbunătăți programarea și sarcini autonome de tip „agent AI” (adică sisteme care pot executa pași multipli în numele utilizatorului). Context: după rezultate și înainte de „ Made by Google ” Pragul de 1 miliard vine la scurt timp după conferința de rezultate pentru trimestrul al doilea din 2026, unde Google a spus că depășise 950 de milioane de utilizatori activi lunar, iar utilizatorii activi zilnic s-ar fi triplat în ultimul an. Anunțul este plasat și înaintea evenimentului „Made by Google”, unde este de așteptat ca Google să lanseze funcții noi bazate pe Gemini pe dispozitivele Pixel. [...]

Aplicația Gemini a depășit pragul de 1 miliard de utilizatori lunari , consolidându-și poziția de produs cu cea mai rapidă creștere din istoria Google , potrivit Google Health . Pentru piață, miza nu este doar dimensiunea audienței, ci faptul că utilizarea se mută accelerat spre interacțiuni vocale, funcții multimodale (cameră, partajare de ecran) și automatizări în aplicații — adică spre scenarii care pot crește dependența de asistent și pot extinde utilizarea în activități de zi cu zi. Cum se schimbă utilizarea: voce, cameră și atașamente Datele prezentate indică o orientare puternică spre interacțiunea vocală și spre rezolvarea de probleme „în timp real”: 63% dintre utilizatori vorbesc direct cu Gemini , inclusiv un număr mai mare de utilizatori „doar voce”. Părinții ocupați sunt cu 43% mai predispuși să folosească vocea pentru sarcini cotidiene. 1 din 5 interacțiuni Gemini Live depășește vocea: utilizatorii folosesc fluxuri video live și partajare de ecran pentru rezolvare de probleme în timp real, popular mai ales la pasionații de bricolaj și la studenți. În zona educației, 38% dintre solicitările legate de școală includ un atașament , semn că utilizarea se bazează frecvent pe documente și materiale încărcate. Funcții cu impact operațional: creație de conținut și automatizări în aplicații Google indică două direcții care pot conta direct pentru productivitate și pentru utilizarea în mediul de afaceri: Gemini generează peste 150 de milioane de imagini pe zi , iar compania susține că funcțiile de creație (imagini, video și audio „într-un singur loc”) sunt folosite de micile afaceri pentru materiale precum cele de marketing. Pe Android, Gemini poate automatiza acțiuni în peste 40 de aplicații populare , inclusiv pentru sarcini precum rezervări sau comenzi. iOS și macOS: bază mare de utilizatori, intensitate mai ridicată pe Mac Pe ecosistemul Apple, Google raportează peste 100 de milioane de utilizatori activi pe iOS , iar utilizatorii „power” de macOS ar formula solicitări („prompturi”) de circa două ori mai des decât pe alte platforme. Ce urmează, în viziunea Google Compania spune că își propune să construiască „pentru următorul miliard” și să facă Gemini „cel mai personal, proactiv și puternic asistent”. În practică, datele publicate sugerează că direcția este extinderea utilizării dincolo de chat: spre voce, multimodal și automatizări, adică spre integrare mai profundă în fluxurile zilnice de lucru și viață. [...]