Știri
Știri din categoria Inteligență artificială

Google integrează automatizări cu Gemini direct în Android, mutând tot mai multe sarcini între aplicații către un „agent” AI, potrivit TechRadar. Noul pachet, numit „Gemini Intelligence”, este prezentat ca un sistem care reduce „fricțiunea” în utilizarea telefonului, preluând pași repetitivi precum completarea de formulare, rezumarea paginilor web sau construirea unui coș de cumpărături dintr-o fotografie.
Miza operațională pentru utilizatori este trecerea de la comenzi punctuale către fluxuri de lucru (task-uri) pe mai mulți pași, în care Android ar urma să execute acțiuni în lanț în numele tău, cu confirmare finală înainte de a „apăsa” efectiv pe butonul de cumpărare/rezervare.
Conform publicației, Google combină Gemini (asistentul său AI) cu Android și Chrome, astfel încât telefonul să poată gestiona sarcini „plictisitoare” și repetitive: să înțeleagă contextul de pe ecran, să extragă informații din aplicații conectate și să automatizeze pași care, până acum, cereau comutări manuale între aplicații.
Direcția este una „mai proactivă” pentru Android: multe funcții pornesc totuși de la un îndemn (prompt) al utilizatorului, dar obiectivul declarat este ca sistemul să ceară mai puțină intervenție manuală.
TechRadar notează că utilitatea reală va depinde de cât de fiabil funcționează Gemini în utilizarea de zi cu zi, în condițiile în care asistenții AI au promis de ani buni simplificarea vieții digitale, dar au fost limitați de comenzi stângace, suport redus între aplicații și erori când sarcinile devin mai complexe.
Pentru moment, calendarul exact și disponibilitatea pe modele/versiuni Android nu sunt detaliate în textul sursă, cu excepția mențiunii că integrarea Gemini în Chrome pe Android începe „mai târziu anul acesta”.
Recomandate

Gemini Spark primește integrare directă cu Chrome , ceea ce îi permite să folosească (cu acordul utilizatorului) conturile autentificate și parolele salvate pentru a automatiza sarcini pe web , potrivit Google Blog . Funcția vizează „comisioane” online mai complexe — de la programarea unor vizionări pentru apartamente salvate până la căutarea opțiunilor de zbor și inițierea procesului de rezervare — dar păstrează utilizatorul în control pentru acțiuni sensibile, precum plățile. Integrarea cu Chrome extinde capabilitățile de navigare ale Spark prin acces la sesiunea de autentificare din browser, ceea ce poate reduce pașii manuali în fluxuri care, în mod normal, cer completări repetate și logări. Google precizează că aceste acțiuni se fac „cu permisiunea” utilizatorului și că, pentru operațiuni sensibile, sarcina este returnată utilizatorului pentru confirmare și finalizare. Securitate și limitări de lansare Google menționează că noua funcționalitate este construită cu protecții împotriva unor amenințări precum „prompt injection” (o tehnică prin care un atacator încearcă să manipuleze instrucțiunile unui model de inteligență artificială pentru a-l determina să execute acțiuni nedorite). În același timp, compania subliniază că utilizatorul rămâne „în buclă” pentru decizii critice, în special cele legate de plăți. Capabilitățile de „auto browse” prin Chrome sunt, în primă fază, în curs de lansare în SUA, cu planuri de extindere în alte regiuni ulterior. Google nu oferă un calendar pentru extinderea internațională. Extinderea accesului: peste 160 de țări, pentru abonații Google AI Pro Separat de integrarea cu Chrome, Google anunță extinderea accesului la Spark pentru abonații Google AI Pro în „peste 160 de țări” suplimentare, începând de astăzi. Miza operațională este creșterea bazei de utilizatori care pot folosi Spark pentru automatizarea sarcinilor zilnice, însă articolul nu detaliază ce piețe sunt incluse sau dacă există diferențe de funcționalitate între regiuni. Pentru lista țărilor, Google indică o pagină de suport. [...]

Aplicația Gemini a depășit pragul de 1 miliard de utilizatori lunari , consolidându-și poziția de produs cu cea mai rapidă creștere din istoria Google , potrivit Google Health . Pentru piață, miza nu este doar dimensiunea audienței, ci faptul că utilizarea se mută accelerat spre interacțiuni vocale, funcții multimodale (cameră, partajare de ecran) și automatizări în aplicații — adică spre scenarii care pot crește dependența de asistent și pot extinde utilizarea în activități de zi cu zi. Cum se schimbă utilizarea: voce, cameră și atașamente Datele prezentate indică o orientare puternică spre interacțiunea vocală și spre rezolvarea de probleme „în timp real”: 63% dintre utilizatori vorbesc direct cu Gemini , inclusiv un număr mai mare de utilizatori „doar voce”. Părinții ocupați sunt cu 43% mai predispuși să folosească vocea pentru sarcini cotidiene. 1 din 5 interacțiuni Gemini Live depășește vocea: utilizatorii folosesc fluxuri video live și partajare de ecran pentru rezolvare de probleme în timp real, popular mai ales la pasionații de bricolaj și la studenți. În zona educației, 38% dintre solicitările legate de școală includ un atașament , semn că utilizarea se bazează frecvent pe documente și materiale încărcate. Funcții cu impact operațional: creație de conținut și automatizări în aplicații Google indică două direcții care pot conta direct pentru productivitate și pentru utilizarea în mediul de afaceri: Gemini generează peste 150 de milioane de imagini pe zi , iar compania susține că funcțiile de creație (imagini, video și audio „într-un singur loc”) sunt folosite de micile afaceri pentru materiale precum cele de marketing. Pe Android, Gemini poate automatiza acțiuni în peste 40 de aplicații populare , inclusiv pentru sarcini precum rezervări sau comenzi. iOS și macOS: bază mare de utilizatori, intensitate mai ridicată pe Mac Pe ecosistemul Apple, Google raportează peste 100 de milioane de utilizatori activi pe iOS , iar utilizatorii „power” de macOS ar formula solicitări („prompturi”) de circa două ori mai des decât pe alte platforme. Ce urmează, în viziunea Google Compania spune că își propune să construiască „pentru următorul miliard” și să facă Gemini „cel mai personal, proactiv și puternic asistent”. În practică, datele publicate sugerează că direcția este extinderea utilizării dincolo de chat: spre voce, multimodal și automatizări, adică spre integrare mai profundă în fluxurile zilnice de lucru și viață. [...]

Modelul de uragane al DeepMind a câștigat timp operațional pentru prognoze, dar rămâne o „cutie neagră” și ridică o problemă practică: meteorologii îl pot folosi ca avantaj, fără să știe încă ce semnal fizic „vede” în date, potrivit Ars Technica . Modelul de inteligență artificială pare să extragă informație relevantă din date cu rezoluție mai mică și să o transforme în predicții mai timpurii despre intensitatea furtunilor, însă cercetătorii nu știu ce anume captează. „Este o cutie neagră la finalul zilei, dar asta le dă fizicienilor un semnal că se întâmplă ceva care nu era înțeles anterior”, spune Alet. Ce schimbă în munca de prognoză: mai multe scenarii, mai repede Spre deosebire de o prognoză singulară, modelul generează o plajă de scenarii posibile pentru o furtună în formare. Abordarea urmărește să surprindă efecte de tip „fluture” — situații în care o abatere mică poate produce schimbări mari ulterior — iar prognoziștii pot folosi aceste ieșiri împreună cu cele ale altor modele pentru a estima evoluția probabilă a sistemului. Un element operațional important este creșterea masivă a numărului de simulări: anul trecut modelul producea 50 de scenarii pe furtună, iar acum generează 1.000. „Asta este ceva ce, cu puterea noastră de calcul, pur și simplu nu putem face cu modelele numerice existente”, spune Musgrave. Limitarea-cheie: performanța nu garantează consistență, iar oamenii rămân esențiali Brennan descrie modelul DeepMind drept un instrument valoros, dar insistă că este doar unul dintre multe. El avertizează că rezultatele bune într-un sezon sau pentru o furtună nu înseamnă automat că același model va fi cel mai bun în sezonul următor. „Nu există nicio garanție că un model, pentru că a mers bine anul trecut sau a mers foarte bine pentru această furtună, va fi neapărat cel mai bun pentru sezonul următor sau următoarea furtună.” În plus, spune el, componenta umană rămâne critică: uraganul nu înseamnă doar traiectorie și intensitate, ci traducerea prognozei în impact — iar impactul este cel care ucide oameni. Ce urmează: modelele WeatherNext vor fi publicate ca open-source Google DeepMind a anunțat că va publica în regim open-source modelele WeatherNext folosite în sezonul uraganelor, astfel încât cercetătorii să le poată utiliza și îmbunătăți. Alet speră că deschiderea către comunitatea de cercetare va ajuta inclusiv la înțelegerea mai bună a modului în care funcționează cicloanele. Materialul citat de Ars Technica provine inițial dintr-o relatare publicată de Wired . [...]

Google își reorganizează conducerea AI pentru a accelera dezvoltarea Gemini și cercetarea de frontieră , într-o mișcare care mută responsabilitățile operaționale de la Demis Hassabis către Koray Kavukcuoglu și repoziționează rolurile la nivel de Alphabet, potrivit Google Blog . Schimbarea are o miză operațională directă: Sundar Pichai spune că Google vrea să „accelereze” execuția pe „frontiera AI”, în timp ce compania își asumă și obiectivul de a influența direcția AGI (inteligență artificială generală). În același mesaj intern, Pichai indică cererea ridicată pentru modelele Gemini în rândul dezvoltatorilor și companiilor și notează că aplicația Gemini a ajuns la „peste 950 de milioane” de utilizatori lunari. Ce se schimbă în Google DeepMind și la nivel de Alphabet Pichai anunță că Demis Hassabis va deveni președinte (Chair) al Google DeepMind și Chief Scientist al Alphabet, păstrând în același timp conducerea Isomorphic Labs . În paralel, Koray Kavukcuoglu (în prezent CTO al Google DeepMind și Chief AI Architect) este promovat SVP (Senior Vice President) al Google DeepMind și va raporta direct către Pichai. În noua structură, Koray va coordona: dezvoltarea modelelor Gemini; cercetarea „Frontier AI” (cercetare de vârf, la limita capabilităților actuale); echipele aplicației Gemini și cele pentru dezvoltatori. Hassabis spune că renunță la responsabilitățile operaționale de zi cu zi pentru a se concentra pe „imaginea de ansamblu” și pe influențarea pașilor următori în direcția AGI. În mesajul către angajați, el menționează și că va „înclina” mai mult către Isomorphic, cu accent pe aplicații în sănătate. Context: presiune pe viteză și produse, nu doar pe cercetare În mesajul său, Pichai enumeră câteva repere recente din portofoliul Google DeepMind: „Flash” este „la mare căutare”, modelul „Cyber” este „live”, iar modelele Gemma au depășit „900 de milioane” de descărcări. Totodată, Hassabis afirmă că echipa lucrează la „noi modele, inclusiv Gemini 4”. Din perspectiva operațională, reorganizarea separă mai clar: rolul de strategie și influență la nivel de Alphabet (Hassabis, ca Chief Scientist); rolul de execuție și livrare a produselor și modelelor (Koray, ca lider al Google DeepMind). Plecarea lui Jeff Dean și un nou vehicul independent Separat, Pichai anunță că Jeff Dean și Sanjay Ghemawat lansează o „ public benefit corporation ” (o companie cu obiectiv public declarat, pe lângă cel comercial) independentă, pentru a accelera descoperiri în învățare automată, știință și inginerie. Google va rămâne „investitor fondator” și partener de cloud și va colabora cu noua entitate pe un cadru de cercetare pentru sisteme de învățare automată și infrastructură aferentă. Google nu oferă în mesaj detalii financiare despre investiție sau despre structura parteneriatului, iar calendarul implementării schimbărilor nu este precizat. [...]

SpaceX își mută centrul de greutate financiar spre AI , după ce veniturile din divizia de inteligență artificială au urcat la 2,6 miliarde de dolari (aprox. 11,7 miliarde lei), de peste trei ori față de anul anterior, potrivit The Verge . Creșterea vine în principal din contracte prin care compania vinde capacitate de calcul (infrastructură pentru antrenarea și rularea modelelor AI) către alte firme din domeniu, însă SpaceX rămâne pe pierdere la nivel de divizie și, per ansamblu, continuă să ardă numerar. În raportarea trimestrială citată, SpaceX arată că segmentul AI a pierdut 1,5 miliarde de dolari (aprox. 6,8 miliarde lei) în trimestrul curent, ușor mai puțin decât în aceeași perioadă a anului trecut. În paralel, cheltuielile de capital au urcat la 18,37 miliarde de dolari (aprox. 83,5 miliarde lei), semn că expansiunea infrastructurii necesare pentru „calcul AI la scară” apasă puternic pe costuri. SpaceX intră în competiția „neocloud” prin vânzarea de calcul Publicația notează că SpaceX a încheiat acorduri cu Anthropic (în mai) și Google (în iunie) pentru a furniza „compute” – resurse de calcul, de regulă GPU-uri și infrastructura aferentă – poziționându-se în competiție cu furnizori specializați de tip „neocloud” (companii care oferă infrastructură de calcul pentru AI, în afara marilor platforme clasice), precum CoreWeave. Pe un apel cu investitorii, Elon Musk a susținut că SpaceX își construiește capacitatea de calcul AI mai repede decât oricine și că își îmbunătățește semnificativ modelele AI. „Construim capacitate de calcul AI la scară mai repede decât oricine altcineva, credem, și ne îmbunătățim semnificativ modelele AI.” IPO-ul și schimbarea de narativ: „valoarea” ar urma să vină din AI Deși numele companiei trimite la activități spațiale, SpaceX a spus în documentele pentru listare că se așteaptă ca cea mai mare parte a valorii sale să provină din AI. The Verge amintește că SpaceX a avut în iunie cel mai mare IPO de până acum și că, în documentația aferentă, compania a indicat inclusiv ambiția de a construi centre de date în spațiu. În structura raportată, SpaceX are trei segmente: space, AI și „connectivity” ( Starlink ). În trimestrul citat, segmentul „space” a generat 962 milioane de dolari (aprox. 4,4 miliarde lei), iar Starlink a avut venituri de 4,2 miliarde de dolari (aprox. 19,1 miliarde lei). Modelul Grok, sub presiune reputațională și competitivă În același material se menționează că Grok, modelul AI al SpaceX, a fost criticat pentru generarea de imagini cu „dezbrăcarea” femeilor și copiilor fără consimțământ și că a rămas mult în urmă față de alți jucători din cursa AI. Pentru investitori, combinația dintre venituri AI în creștere și pierderi încă mari sugerează o tranziție accelerată către un profil de companie de infrastructură pentru AI, dar cu o execuție costisitoare, în care ritmul investițiilor (capex) devine variabila-cheie de urmărit în trimestrele următoare. [...]

Google își mută accentul pe „agenți” și automatizare, cu modele Gemini mai eficiente și instrumente care pot acționa în conturile utilizatorilor , potrivit Google AI Blog , într-un rezumat al principalelor anunțuri din iulie 2026. Miza operațională este reducerea costurilor și a timpilor de răspuns pentru aplicații AI rulate în producție, dar și extinderea capabilităților către sarcini concrete, inclusiv în lumea fizică (robotică) și pe web. Google spune că a lansat trei modele noi din familia Gemini – Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber – orientate către dezvoltatori și companii care construiesc „agenți” AI (sisteme care pot planifica și executa sarcini). Argumentul central este eficiența: mai bună utilizare a „tokenilor” (unități de text procesate de model), latență mai mică și performanță mai predictibilă, pentru a putea scala fluxuri de lucru „agentice” în producție. Detaliile sunt prezentate în materialul dedicat despre modele: Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber . De la „chat” la execuție: Gemini Spark și conectarea aplicațiilor la Search O schimbare cu impact direct asupra modului de utilizare este extinderea Gemini Spark către mai mulți utilizatori la nivel global și adăugarea unei funcții prin care, cu permisiunea utilizatorului, Spark poate folosi conturi autentificate și parole salvate pentru a rezolva „comisioane” pe web (de exemplu, programarea unor vizionări pentru apartamente sau căutarea opțiunilor de zbor și inițierea rezervării). Google descrie aceste actualizări aici: Gemini Spark . În paralel, compania anunță că extinde conectarea aplicațiilor la Search, astfel încât utilizatorii să poată lega în mod securizat servicii uzuale (exemplul menționat este YouTube Music) și să interacționeze cu ele direct în „AI Mode”. Contextul este prezentat în: Connected apps . Robotica: un model de „raționament întrupat” pentru sarcini multi-pas Pe zona de automatizare în lumea fizică, Google anunță Gemini Robotics ER 2 , pe care îl numește cel mai capabil model de „embodied reasoning” (raționament întrupat) de până acum – adică un model proiectat să lege „inteligența” digitală de percepția și acțiunea în mediul real. Conform descrierii, ER 2 ar permite sistemelor să converseze natural, să înțeleagă mediul și să ducă la capăt sarcini complexe, în mai mulți pași. Detalii: Gemini Robotics ER 2 . Instrumente pentru productivitate și „agentizare” în cloud În ecosistemul Google, compania poziționează „Gemini Notebook” ca produs de sine stătător (același cu NotebookLM), dar extins „în ecosistem”, inclusiv în aplicația Gemini și în Google Search, și actualizat cu un „computer cloud securizat”. Prezentarea este aici: Gemini Notebook . Pentru clienții Google Cloud, Google spune că a făcut disponibil în regim general AlphaEvolve, un agent de optimizare a codului „alimentat de Gemini”, pe Gemini Enterprise Agent Platform. Logica de utilizare: utilizatorul oferă un algoritm de bază și obiectivele, iar sistemul caută soluții mai bune și returnează cod optimizat, „ușor de înțeles” pentru oameni. Detalii: AlphaEvolve pe Google Cloud . Context: extinderi pe dispozitive, creativitate și inițiative economice În același rezumat, Google mai indică: prime capabilități ale „Gemini Intelligence” pe noile dispozitive Samsung lansate la Galaxy Unpacked 2026 și o experiență nativă de migrare în Android 17 pentru transfer de date de pe iPhone, fără aplicație separată: Galaxy Unpacked 2026 și migrare iPhone–Android ; actualizări în Google Vids, inclusiv „Gemini Omni” și „avataruri personale” pentru generare și editare video din limbaj natural: Google Vids ; o primă iterație a AI & Economy ATLAS, descris ca un studiu amplu, de-identificat, despre utilizarea AI la muncă și în viața de zi cu zi: AI & Economy ATLAS . Separat, fondatorul Google DeepMind, Demis Hassabis , își prezintă viziunea într-un material publicat pe LinkedIn: Demis Hassabis . Pentru piață, mesajul principal al pachetului de anunțuri este că Google împinge AI-ul din zona de asistență conversațională către sisteme mai eficiente și mai „executive” (agenți), cu implicații directe pentru companii: costuri de rulare, timpi de răspuns, integrare cu aplicații și, în unele cazuri, automatizare care poate opera efectiv în conturile utilizatorilor – ceea ce ridică, inevitabil, miza pe controlul permisiunilor și securitate, chiar dacă rezumatul nu intră în detalii de reglementare. [...]