Știri
Știri din categoria Inteligență artificială

Google extinde personalizarea Gemini la imagini folosind date din contul utilizatorului, o mutare care ridică miza pe integrarea cu ecosistemul propriu și, în același timp, amplifică presiunea de conformare în piețe cu reglementări stricte. Potrivit The Next Web, compania a adăugat generarea de imagini „Nano Banana” în funcția „Personal Intelligence”, astfel încât Gemini să poată crea imagini informate de context personal din Gmail, Photos, Calendar, Drive și alte aplicații Google.
Funcția începe să fie disponibilă în zilele următoare pentru abonații Plus, Pro și Ultra din SUA, iar utilizatorii fără abonament ar urma să primească acces în următoarele săptămâni. Google spune că vrea să extindă disponibilitatea și către Gemini în Chrome pe desktop și către alte piețe, însă Europa este exclusă din lansarea inițială a „Personal Intelligence”.
Până acum, „Personal Intelligence” a fost folosită în principal pentru personalizare în răspunsuri text (de exemplu, întrebări despre planuri de călătorie pe baza confirmărilor din Gmail și a intrărilor din calendar). Prin adăugarea generării de imagini, personalizarea se mută și în zona vizuală: Gemini poate produce imagini care țin cont de preferințe, context și, în unele cazuri, de fotografii personale.
Google introduce și un buton „sources” („surse”), care arată din ce informații a derivat Gemini contextul pentru fiecare imagine personalizată, oferind utilizatorilor vizibilitate asupra datelor care au influențat rezultatul.
Publicația notează că „Nano Banana” este capabilitatea nativă de generare de imagini din familia Gemini, distinctă de Imagen, linia Google dedicată exclusiv conversiei text-imagine. Diferența de poziționare este că Imagen vizează calitatea și fluxurile profesionale, în timp ce Nano Banana e gândit pentru generare conversațională direct în interfața Gemini, cu intrări din text, imagini sau combinații.
Familia Nano Banana are trei versiuni, potrivit sursei:
Riscul evident, subliniat în material, este că accesul unui generator de imagini la fotografii, e-mailuri și alte date personale poate crea probleme pe care controalele „opt-in” (activare voluntară) nu le elimină complet. Google afirmă că nu își antrenează inteligența artificială pe date personale, însă sistemul trebuie să proceseze aceste date pentru a genera rezultate relevante (diferența dintre „antrenare” și „folosire la inferență” este tehnică și poate fi greu de înțeles pentru utilizatori).
Excluderea Europei din lansarea inițială sugerează că Google anticipează obstacole în raport cu GDPR și cu viitorul cadru din AI Act, în condițiile în care personalizarea se bazează tocmai pe conectarea la date din cont.
Google nu a comunicat modificări de preț sau costuri adiționale pentru generarea de imagini prin „Personal Intelligence” cu Nano Banana. Din informațiile disponibile, funcția pare inclusă în nivelurile existente (de la gratuit la Plus, Pro și Ultra), iar ritmul de acces depinde de tipul de abonament.
Recomandate

Google își extinde colaborarea cu MrBeast într-un parteneriat pe mai mulți ani, care mută utilizarea Gemini din zona de divertisment în demonstrații publice de utilizare practică și include și Google Health , potrivit Google Blog . În esență, Google își leagă produsele de un creator cu audiență uriașă pentru a arăta, în contexte „de teren”, cum poate fi folosită inteligența artificială generativă (AI care produce conținut și sugestii) în situații concrete. Parteneriatul este încheiat cu Beast Industries și „extinde relația dincolo de YouTube” către Gemini și Google Health. Google îl prezintă pe Jimmy Donaldson (MrBeast) drept „primul creator” care a atins 500 de milioane de abonați pe YouTube , iar colaborarea urmărește ca acesta să folosească Gemini pentru a-și executa concepte „mai sălbatice” și, în paralel, să arate cum Google Health poate sprijini obiective zilnice de fitness și stare de bine. Ce se vede prima dată: un clip pe 5 septembrie, cu Gemini folosit în scenarii extreme Primul material anunțat este un nou videoclip MrBeast programat pentru 5 septembrie, în care echipa încearcă să supraviețuiască în „unele dintre cele mai extreme și periculoase climate” de pe Pământ. Conform sursei, echipele vor concura în trei medii: junglă, deșert, Arctica, folosind Gemini pentru a identifica pericole, a face față schimbărilor brutale de vreme și a rămâne „cu un pas înainte”. Extinderea dincolo de YouTube: campanie Gemini și integrarea Fitbit Air Google mai spune că MrBeast va apărea într-un „nou lansat” (recent lansat) demers de promovare pentru Gemini, unde va arăta cum folosește aplicația ca partener pentru partea de logistică a cascadoriilor sale. În plus, compania precizează că Jimmy va integra „Fitbit Air” într-o provocare viitoare. Google nu oferă în material detalii financiare, termeni contractuali sau calendar complet al activărilor, dar descrie colaborarea drept începutul unui proiect mai amplu, cu noi apariții pe canalele MrBeast și pe conturile Gemini. [...]

Gemini Live primește funcții „agentice” care pot rula sarcini în fundal, pe zile sau săptămâni , ceea ce mută aplicația de la conversație la execuție efectivă de taskuri — cu impact direct asupra modului în care utilizatorii își gestionează munca și timpul, potrivit Google Blog . Actualizarea vizează un set de funcții de productivitate care folosesc comenzi vocale pentru a declanșa acțiuni în aplicațiile Google, într-un flux „hands-free” (fără atingerea ecranului). Google notează că 63% dintre utilizatori vorbesc cu Gemini cu voce tare, motiv pentru care a prioritizat acest tip de interacțiune. Spark : sarcini complexe, multi-pas, rulate autonom Gemini Live se integrează cu Spark , un mecanism prin care utilizatorul poate seta, prin voce, sarcini mai elaborate care „rulează singure”. Conform descrierii, Spark funcționează în Google Docs, Sheets, Drive și pe web și poate gestiona joburi programate pe termen mai lung, inclusiv când utilizatorul nu folosește activ aplicația. Exemplele date includ transformarea unor idei spuse „în treacăt” într-o structură de document în Google Docs sau menținerea unui plan săptămânal de mese și generarea unei liste de cumpărături pe baza rețetelor salvate în Docs. Daily Brief: rezumat vocal al zilei din Gmail și Calendar O altă funcție introdusă este Daily Brief , care oferă un rezumat vorbit al elementelor importante din zi. Utilizatorul poate cere „care este briefingul meu zilnic?”, iar Gemini combină actualizări relevante din Gmail și Calendar într-un „digest” concis, fără a fi nevoie de ecran. Gestionarea inboxului din voce: căutare, sumarizare, arhivare Google introduce și o funcție de administrare a inboxului „hands-free”, în care Gemini devine un partener conversațional pentru sortarea rapidă a e-mailurilor din Gmail. Din comenzi vocale, utilizatorul poate căuta, sumariza, marca (star), arhiva sau șterge mesaje, inclusiv pe criterii de urgență. „Personal Intelligence”: memorie și context din conversații și aplicații conectate Prin Personal Intelligence , Gemini Live „ține minte” ce a fost discutat anterior și conectează informații din conversații cu aplicații Google precum Gmail, Photos, Search și YouTube, pentru a răspunde mai precis la întrebări recurente sau legate de context (de exemplu, numele unui restaurant menționat anterior sau o rețetă discutată recent). Pentru a folosi aceste capabilități, utilizatorii trebuie să aleagă conectarea aplicațiilor în setările Gemini Personal Intelligence și să pornească modul Live din aplicația Gemini. Google indică și trimiterea la politica de confidențialitate , fără a detalia în acest material cum sunt procesate datele pentru noile funcții. [...]

Google extinde controlul vocal în Workspace , introducând trei funcții conversaționale care pot reduce timpul pierdut cu căutări și redactare în Gmail, Docs și Keep, potrivit Google . Noutatea are miză operațională pentru utilizatori și echipe: interacțiunea „hands-free” (fără tastatură) mută o parte din munca de căutare, structurare și redactare în fluxuri ghidate de modele audio Gemini. Ce se schimbă în Gmail, Docs și Keep Google lansează capabilități bazate pe „ Gemini Audio models ” (modele de inteligență artificială care înțeleg și generează vorbire), prezentate anterior în Workspace la I/O, iar acum disponibile ca funcții noi în trei aplicații. Gmail Live: căutare conversațională în inbox Gmail Live permite utilizatorilor să „întrebe” direct, pe voce, lucruri precum „Care este numărul porții de îmbarcare?” sau „Ce se întâmplă săptămâna aceasta la școala copilului?”, iar funcția scanează inboxul și returnează rapid răspunsuri, fără căutare manuală prin fire lungi de e-mailuri. Docs Live: redactare și structurare prin dialog Docs Live este poziționat ca „partener de idei” și coautor: utilizatorul vorbește, iar instrumentul organizează ideile și structurează documentul pentru a ajunge mai repede la o primă versiune. Google precizează că, „cu permisiunea” utilizatorului, Docs Live poate extrage detalii relevante din Gmail, Drive și Chat, dar și de pe web, pentru a completa contextul. Keep Live: transformă „brain dump” în notițe organizate În Keep, funcția vocală nouă preia un flux liber de idei și îl procesează „în fundal”, transformându-l în liste și notițe structurate, fără tastare. Disponibilitate și condiții de acces Funcțiile „conversaționale” încep să fie distribuite „săptămâna aceasta”, conform Google. Accesul este condiționat de tipul de abonament: Gmail Live și Keep Live : disponibile pentru abonații Google AI Plus, Pro și Ultra (detalii despre planuri: Google One – Google AI plans ). Docs Live : disponibil pentru abonații Pro și Ultra . Pentru clienții Google Workspace business , Google spune că funcțiile „vin în curând”, fără un calendar mai precis în material. Ce rămâne de urmărit pentru companii Pentru organizații, miza imediată este modul în care aceste funcții vor fi integrate în pachetele business și ce politici interne vor fi necesare pentru utilizarea extragerii de informații din e-mail și fișiere „cu permisiunea” utilizatorului. Google trimite la politica sa de confidențialitate pentru cadrul general: Google Privacy Policy . [...]

Un judecător federal din SUA a sugerat că „ AI Overviews ” poate crea o piață nouă pentru „inputurile” IA și poate ridica probleme antitrust , într-o audiere în care a criticat dur felul în care Google folosește conținutul presei pentru răspunsurile generate de inteligență artificială, potrivit Ziarul Financiar . Audierea a avut loc săptămâna trecută la tribunalul federal din Washington și a fost condusă de judecătorul Amit Mehta , cel care a decis în august 2024 că Google deține un monopol ilegal pe piața căutării online. De această dată, discuția s-a concentrat pe „AI Overviews”, funcția care afișează rezumate generate de IA deasupra rezultatelor clasice de căutare. În timpul audierilor, Mehta a spus că Google „aspiră” conținutul editorilor pentru a-și rafina rezultatele bazate pe IA „într-un mod care pare cu adevărat nedrept” și a avertizat că îmbunătățirile de produs nu sunt „complet imune” la controlul antitrust, potrivit relatării publicației juridice MLex, citată de ZF. Două procese consolidate, aceeași acuzație: efectul asupra presei Instanța a analizat cererile Google de respingere a două procese antitrust, consolidate pentru această audiere: procesul intentat în septembrie 2025 de Penske Media (editor al unor titluri precum Rolling Stone, Variety, Billboard, The Hollywood Reporter și Deadline); procesul deschis în februarie 2025 de compania de educație online Chegg. Ambele vizează efectele „AI Overviews” și modul în care rezumatele generate de IA folosesc conținutul editorilor. Linia de apărare a Google și reacția judecătorului Avocații Google au susținut că „AI Overviews” este o „îmbunătățire de produs” și au descris relația istorică dintre Google și editori — în care editorii permit scanarea conținutului, iar motorul de căutare trimite trafic — drept „un istoric vag de relații comerciale”, potrivit lui Jason Kint, directorul general al Digital Content Next (DCN), asociația editorilor premium americani, prezent la audiere. În versiunea companiei, riscul ca modelul să lovească presa ar fi „mult prea speculativ”. Judecătorul Mehta nu a părut convins și a replicat că situația, în ansamblu, „pare, toată, cu adevărat nedreaptă”, potrivit lui Kint. Acesta a mai relatat că judecătorul a considerat că „îmbunătățirea de produs” invocată de Google ar fi fost construită „pe spinarea editorilor”, care nu au control asupra felului în care compania le folosește conținutul. Avocatul Penske a rezumat dezechilibrul astfel: editorii, „în cea mai mare parte, nu pot spune nu”. De ce contează: semnalul antitrust despre o „piață” a inputurilor pentru IA Un element cu potențial impact de reglementare este observația judecătorului că „se formează clar o piață” pentru inputurile inteligenței artificiale generative — adică pentru conținutul și datele folosite pentru a produce răspunsuri IA. Potrivit relatării DCN, Mehta a sugerat și că situația ar semăna, în anumite privințe, cu o „facilitate esențială” (infrastructură de care depinde o întreagă piață), dar a precizat că nu îi revine, în acest stadiu, să facă o asemenea calificare. Ce urmează depinde de modul în care instanța va trata cererile de respingere și de felul în care va interpreta, în cheie antitrust, relația dintre un produs IA integrat în căutare și dependența editorilor de distribuția prin Google. [...]

Un verdict al CJUE ar putea stabili dacă modelele AI vor plăti pentru conținutul folosit la antrenare , cu efect direct asupra costurilor și regulilor de funcționare pentru furnizorii de inteligență artificială și asupra veniturilor editorilor, potrivit HotNews . Miza este procesul „ Like Company vs Google Irlanda ”, ajuns la Curtea de Justiție a Uniunii Europene (CJUE), care poate clarifica dacă și când utilizarea conținutului protejat de drepturi de autor în antrenarea și răspunsurile chatboților intră sub incidența legislației europene. De la un rezumat Gemini la o întrebare-cheie pentru piața AI Disputa a pornit după ce un utilizator a cerut chatbot-ului Gemini (Google) să rezume un articol publicat în iulie 2023 de Balatonkornyeke, un agregator de știri locale din Ungaria, care relata despre ideea unui cântăreț maghiar de a introduce delfini în Lacul Balaton. Potrivit Tribunalului Regional din Budapesta, răspunsul generat de chatbot a inclus și detalii care nu existau în articolul original. Instanța maghiară a trimis cazul la CJUE pe 3 aprilie 2025, iar pe 10 martie 2026 Marea Cameră a CJUE a organizat o audiere orală descrisă de observatori juridici drept prima care a abordat direct legătura dintre inteligența artificială și dreptul UE privind drepturile de autor. Linia de conflict: „antrenare” versus „copiere” În esență, întrebarea este dacă, atunci când un sistem AI este antrenat pe conținut protejat și apoi produce răspunsuri pe baza lui, se aplică dreptul de autor. Argumentul Google, așa cum este prezentat în material, este că modelul nu „stochează” articole precum o bază de date, ci învață tipare statistice; din această perspectivă, compania susține că nu are loc o „copiere” atunci când sistemul generează un răspuns, ci o predicție de limbaj. De cealaltă parte, editorii și jurnaliștii susțin că produsele AI folosesc munca lor pentru a livra răspunsuri directe, reducând nevoia utilizatorilor de a mai accesa site-ul sursă. În plus, ei invocă utilizarea fără permisiune sau compensație, mai ales când rezultatele generate seamănă mult cu materialele originale sau concurează cu acestea. Ce spune cadrul legal european și unde e „zona gri” HotNews notează că legislația UE are deja instrumente relevante, deși nu au fost gândite pentru chatboții actuali: o directivă din 2001 privind controlul deținătorilor de drepturi asupra reproducerii și comunicării operelor; o directivă din 2019 care a introdus excepții pentru „extragerea de text și date” (prelucrare automată a unor volume mari de conținut), inclusiv din materiale accesibile gratuit, cu excepția cazului în care titularii de drepturi optează explicit să nu permită utilizarea. Limitele acestor excepții, în special în contexte comerciale de inteligență artificială, sunt însă „neverificate” juridic, iar procesul de la CJUE ar putea forța o delimitare. Trei scenarii cu impact direct în costuri și obligații Materialul descrie trei rezultate posibile ale deciziei CJUE: Antrenarea AI este „reproducere” în sensul dreptului de autor: dezvoltatorii ar putea avea nevoie de licențe și ar trebui să respecte opțiunile de excludere sau să se bazeze pe excepții specifice. Antrenarea AI nu intră sub incidența dreptului de autor : unul dintre cele mai puternice argumente juridice ale editorilor ar putea dispărea. Accent pe „rezultate” (output) : instanța ar decide când un răspuns al unui chatbot este suficient de apropiat de un articol protejat încât să constituie încălcare. De ce contează acum: Legea AI cere conformitate, dar nu definește „conformitatea” Cazul vine într-un moment în care UE implementează deja Legea privind inteligența artificială, care impune furnizorilor de modele mari să adopte politici de conformitate cu drepturile de autor, să respecte opțiunile de excludere ale titularilor și să publice rezumate ale conținutului folosit la instruire. Dar, potrivit articolului, legea nu rezolvă problema de fond: cere respectarea dreptului de autor fără să stabilească exact ce înseamnă asta în practică. În acest context, hotărârea CJUE ar putea deveni piesa care dă sens operațional obligațiilor din Legea AI. „Dacă instanța e de acord cu Google, presa privată moare” Paul Nemitz, expert în digitalizare și profesor asociat la Colegiul Europei, avertizează că miza pentru mass-media independentă este majoră: „Dacă instanța este de acord cu argumentele Google, chiar și parțial, presa privată și publicațiile private din Europa sunt moarte. Doar presa de stat va supraviețui”. Nemitz susține că excepția pentru extragerea de text și date a fost concepută pentru progres științific, nu pentru extragerea la scară largă a producției jurnalistice și culturale de către sisteme comerciale de AI, iar interpretarea ar trebui corelată cu drepturile fundamentale ale UE și rolul democratic al jurnalismului. În paralel, Societatea Europeană pentru Drepturi de Autor cere prudență și avertizează împotriva unei hotărâri atât de ample încât să creeze o piață de licențiere accesibilă doar celor mai mari furnizori de AI, deși recunoaște îngrijorările legate de utilizarea nelicențiată a conținutului protejat. Ce urmează în dosar Avizul avocatului general al CJUE este programat pentru 3 septembrie, iar hotărârea finală este anticipată la sfârșitul acestui an. Decizia este așteptată să influențeze direct modul în care companiile AI își pot construi seturile de date, ce licențe ar putea fi necesare și cât de mult se poate baza industria pe excepțiile existente în dreptul european. [...]

Google mută transcrierea vocală spre „text editat” , odată cu lansarea modelului Gemini 3.5 Transcribe, care nu doar transformă vocea în text, ci și elimină automat ticuri verbale și autocorecții — o schimbare cu impact direct asupra modului în care utilizatorii și companiile pot folosi dictarea, potrivit IT Home . Modelul este prezentat ca o optimizare a experienței de introducere vocală: poate șterge „ăă”, „îî” și alte interjecții, dar și ajusta în timp real textul atunci când vorbitorul se corectează imediat după o greșeală. Publicația notează că Gemini 3.5 Transcribe este deja folosit pentru funcția „Rambler” din tastatura Gboard de pe Pixel 11 și urmează să fie extins treptat în mai multe produse și servicii Google. Ce câștigă utilizatorii: viteză mai mare și mai puține erori Google compară noul model cu motorul anterior de transcriere, Chirp 3. Conform datelor citate, Gemini 3.5 Transcribe ar aduce: o creștere estimată a vitezei cu aproximativ 70% de la vorbire la textul final; o reducere a ratei de eroare în scenarii de vorbire în timp real la 5,5%, față de 7,32% la Chirp 3. Deși îmbunătățirea de acuratețe nu este descrisă ca „foarte mare”, efectul practic invocat este reducerea volumului de corecturi manuale, relevant pentru cei care folosesc frecvent dictarea. De ce contează: transcrierea devine și „curățare” de conținut, cu riscuri Dincolo de recunoașterea cuvintelor, modelul „încearcă să înțeleagă” intenția utilizatorului, inclusiv prin eliminarea automată a fragmentelor care fac propozițiile mai puțin fluente. Utilizatorii pot încărca și un glosar personalizat, pentru recunoașterea mai bună a termenilor de specialitate. Modelul suportă 85 de limbi și poate procesa înregistrări cu până la trei vorbitori. Totuși, aceeași logică de „ordonare” a textului ridică o limitare importantă: în procesul de „curățare”, AI poate modifica formularea originală. Sursa avertizează că, în contexte unde este necesară redarea fidelă a declarațiilor (de exemplu, situații în care „nu se poate schimba exprimarea”), această „lustruire inteligentă” poate fi nepotrivită. [...]