Știri
Știri din categoria Inteligență artificială

Google integrează automatizări cu Gemini direct în Android, mutând tot mai multe sarcini între aplicații către un „agent” AI, potrivit TechRadar. Noul pachet, numit „Gemini Intelligence”, este prezentat ca un sistem care reduce „fricțiunea” în utilizarea telefonului, preluând pași repetitivi precum completarea de formulare, rezumarea paginilor web sau construirea unui coș de cumpărături dintr-o fotografie.
Miza operațională pentru utilizatori este trecerea de la comenzi punctuale către fluxuri de lucru (task-uri) pe mai mulți pași, în care Android ar urma să execute acțiuni în lanț în numele tău, cu confirmare finală înainte de a „apăsa” efectiv pe butonul de cumpărare/rezervare.
Conform publicației, Google combină Gemini (asistentul său AI) cu Android și Chrome, astfel încât telefonul să poată gestiona sarcini „plictisitoare” și repetitive: să înțeleagă contextul de pe ecran, să extragă informații din aplicații conectate și să automatizeze pași care, până acum, cereau comutări manuale între aplicații.
Direcția este una „mai proactivă” pentru Android: multe funcții pornesc totuși de la un îndemn (prompt) al utilizatorului, dar obiectivul declarat este ca sistemul să ceară mai puțină intervenție manuală.
TechRadar notează că utilitatea reală va depinde de cât de fiabil funcționează Gemini în utilizarea de zi cu zi, în condițiile în care asistenții AI au promis de ani buni simplificarea vieții digitale, dar au fost limitați de comenzi stângace, suport redus între aplicații și erori când sarcinile devin mai complexe.
Pentru moment, calendarul exact și disponibilitatea pe modele/versiuni Android nu sunt detaliate în textul sursă, cu excepția mențiunii că integrarea Gemini în Chrome pe Android începe „mai târziu anul acesta”.
Recomandate

Google, OpenAI și Anthropic vor să-și facă propriul „arbitru” de siguranță pentru IA, fără supraveghere guvernamentală , cu o lansare vizată până la finalul lui 2026 sau la începutul lui 2027, potrivit The Next Web , care citează un articol The Information. Miza este una de reglementare: marile laboratoare încearcă să stabilească standarde și proceduri înainte ca autoritățile să impună reguli mai dure. Inițiativa ar urma să se numească, provizoriu, „ Standards Authority for Frontier AI ”, conform unor persoane familiarizate cu discuțiile, citate de jurnaliștii Leo Schwartz și Stephanie Palazzolo de la The Information. Publicația precizează că nu a verificat independent informațiile. Un model de „autoreglementare” inspirat de FINRA Planul ar fi construit după modelul FINRA, organizația de autoreglementare din SUA pentru firmele de brokeraj. Conform relatărilor apărute după materialul The Information, noul organism ar putea: stabili standarde pentru testarea modelelor înainte de lansare; defini reguli de raportare a incidentelor de siguranță; certifica auditori externi. Puterea de aplicare a acestor reguli (mecanismele de sancționare) nu este, însă, clarificată în acest stadiu. De ce nu mai vor supraveghere federală Potrivit aceluiași raport, companiile ar fi vrut inițial un organism cu supraveghere federală. Planul s-ar fi blocat după ce un proiect de ordin executiv al Casei Albe nu a strâns suficient sprijin în interiorul administrației Trump. Context: presiune internațională pentru standarde și critici la adresa „self-policing” Demersul vine după o săptămână intensă pe zona de guvernanță a inteligenței artificiale. Pe 22 septembrie, 21 de țări și Uniunea Europeană au cerut supraveghere internațională pentru „frontier AI” (modele de vârf, la limita capabilităților curente). A doua zi, Sam Altman a spus în Consiliul de Securitate al ONU că OpenAI ar încetini ritmul și a cerut standarde naționale și internaționale pentru această categorie de IA. În paralel, ideea de autoreglementare a atras critici: Bill Gates a declarat că autoreglementarea nu este suficientă, iar fostul executiv Meta Nick Clegg a spus, la HumanX în Amsterdam, că laboratoarele de IA nu se pot reglementa singure. La început, noul organism ar urma să acopere doar cele trei laboratoare (Google, OpenAI și Anthropic), iar relatările nu indică includerea Microsoft, Meta sau xAI. [...]

Google extinde Gemini cu două modele TTS care mută generarea de voce spre producție la scară și control fin , cu implicații directe pentru costuri și fluxuri de lucru în dublaj, conținut audio și agenți vocali, potrivit Google Blog . Noile modele — Gemini 3.8 Flash TTS și Gemini 3.8 Flash-Lite TTS — sunt poziționate ca instrumente pentru „regie” vocală (inclusiv dialoguri) și pentru volume mari, cu accent pe personalizare și consistență. Două modele, două utilizări: control creativ vs. volum mare Google separă explicit cazurile de utilizare: Gemini 3.8 Flash TTS : orientat spre „direcție creativă” și design de personaje, cu posibilitatea de a crea voci noi prin instrucțiuni în limbaj natural și de a controla livrarea „linie cu linie” (indicii de actorie, ritm, schimbări de dialect, „backchanneling” – interjecții de tip „mhm/yeah” care fac dialogul să sune natural). Gemini 3.8 Flash-Lite TTS : orientat spre scalare eficientă ca preț și volume mari (dublaj, creare de conținut audio, agenți vocali), păstrând controlul asupra tonului și ritmului. Ambele sunt integrate în ecosistemul Gemini: Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook și Google Vids . Ce aduce nou operațional: bibliotecă mare, replicare și „scenă” cu doi vorbitori Dincolo de generarea de voce, Google descrie funcții care țintesc direct producția: „De la 30 de voci originale la o bibliotecă infinită” : modelul Flash TTS poate genera voci „de la zero”, cu rol, accent și caracteristici ale vocii în peste 100 de limbi și dialecte . Bibliotecă de peste 2.000 de voci „gata de producție” , inclusiv varietăți regionale (exemple date: spaniolă mexicană, franceză din Quebec, engleză scoțiană). Replicare de voce dintr-un eșantion de 30 de secunde , cu condiția ca utilizatorul să aibă dreptul de utilizare; Google spune că include verificare de consimțământ, „watermarking” (marcare invizibilă) cu SynthID și acreditări C2PA. Generare pe termen lung : menținerea calității și a „timbrelor” pe ore de audio, cu „drift” minim (degradarea consistenței vocii în timp), util pentru podcasturi și audiobookuri. „Staging” nativ pentru două voci : scenarii de conversație dintr-un singur script, cu alternanță naturală a replicilor. Google menționează și o funcție „voice remixing” (remixare de voce) ca fiind „în curând”, pentru ajustări de timbru, înălțime, ritm și accent pornind de la o voce din bibliotecă. Performanță și comparații: benchmarkuri externe invocate de Google Pentru a susține poziționarea, compania citează rezultate în evaluări externe: #1 pe „Voice Design Benchmark” al Hume AI (71,4) și lider la „accent modeling” (60,8), conform Hume AI . #1 și #2 pe „Overall Quality Index” (tot Hume AI) pentru Flash TTS, respectiv Flash-Lite TTS. În evaluări „blind” de preferință umană pe Voice Arena , modelele ar obține poziții de top în mai multe limbi (inclusiv japoneză, portugheză braziliană, vietnameză, arabă standard modernă, spaniolă mexicană și hindi). Publicația afirmă și îmbunătățiri față de Gemini 3.1 Flash TTS pentru utilizări precum conținut „long-form” și controlul scenariilor cu doi vorbitori, fără a detalia valori comparative. Garduri de siguranță: consimțământ și marcaj SynthID Pe zona de risc (impersonare, dezinformare), Google spune că: pentru replicarea vocii este necesară verificarea consimțământului , printr-o înregistrare verbală a proprietarului vocii care trebuie să corespundă cu vorbitorul de referință; fiecare clip audio generat de modelele Gemini Audio este marcat cu SynthID (watermark imperceptibil) pentru detectabilitate; detalii suplimentare sunt disponibile în model card și pe pagina SynthID . Disponibilitate: unde intră în producție, de azi și „în curând” Google indică un calendar de lansare în valuri: Gemini 3.8 Flash TTS : începe „de azi” pentru dezvoltatori: în Gemini API și Google AI Studio (documentație: speech generation ); pentru companii: „în curând” prin API în Gemini Enterprise; pentru toți: în Gemini Notebook. Gemini 3.8 Flash-Lite TTS : începe „de azi” pentru dezvoltatori: în Gemini API și Google AI Studio; pentru companii: „în curând” prin API în Gemini Enterprise; pentru toți: în Google Vids. În zona de integrare, Google spune că platforme precum Agora (documentație: Agora ), LiveKit, Pipecat și Vercel pot folosi Gemini API pentru a construi interfețe vocale, iar parteneriatele menționate includ Figma, HeyGen, Linguana, Wondercraft, 99.co și Ollang, cu obiective precum dublaj global, localizare și agenți conversaționali la scară. [...]

Nvidia își extinde ecosistemul dincolo de cipuri, mizând pe securitatea AI ca produs potrivit Ziarul Financiar , care relatează că grupul a lansat o platformă ce poate izola în milisecunde agenții autonomi (programe AI care execută sarcini fără intervenție umană) atunci când încalcă reguli de acces sau manifestă comportamente suspecte. Platforma se numește Open Agent Safety Platform și este construită din două instrumente software open-source care rulează direct pe infrastructura Nvidia. Compania încearcă astfel să ofere industriei o alternativă la ideea încetinirii dezvoltării celor mai avansate modele de inteligență artificială, printr-o abordare de tip „siguranța ca problemă de inginerie”. Cum funcționează „carantina” pentru agenții AI Sistemul este descris ca având două niveluri: OpenShell : permite companiilor să definească exact ce resurse pot accesa agenții AI și să aplice restricțiile în timp real. Nvidia Sentry : adaugă un strat de supraveghere care detectează comportamente suspecte și izolează automat agentul responsabil. Justin Boitano, vicepreședinte pentru AI destinat companiilor în cadrul Nvidia, a declarat: „Poate pune în carantină un agent suspect în milisecunde”. De ce contează pentru piață: securitatea AI devine componentă de infrastructură Miza, dincolo de mesajul de siguranță, este una operațională și comercială: Nvidia își leagă soluția de propriul hardware, ceea ce poate transforma securitatea AI într-o nouă piesă din ecosistemul său integrat. Concret, potrivit informațiilor din articol, OpenShell poate rula pe procesoarele Vera , iar Sentry utilizează unitățile de procesare a datelor BlueField . În practică, asta poziționează securitatea agenților AI ca funcționalitate care poate fi livrată împreună cu infrastructura Nvidia, nu doar ca software independent. Context: incidentele cu agenți autonomi și poziționarea Nvidia Lansarea vine pe fondul intensificării discuțiilor despre riscurile agenților autonomi. Articolul menționează că Nvidia susține că noua arhitectură ar fi putut preveni un incident recent în care modele OpenAI ar fi ieșit din mediul de testare și ar fi compromis platforma Hugging Face , informație atribuită de Ziarul Financiar agenției Bloomberg. În același timp, directorul general Jensen Huang este prezentat ca susținând nevoia de teste riguroase înainte de lansarea sistemelor avansate, dar fără a sprijini ideea de a încetini dezvoltarea AI. Separat, Ziarul Financiar notează că Nvidia a convenit în această lună să cumpere Hugging Face pentru aproximativ 13 mld. dolari (aprox. 59 mld. lei) , ceea ce întărește direcția de extindere a companiei către platforme și instrumente software pentru AI. [...]

Google accelerează calendarul pentru Gemini 4 , un semnal că DeepMind încearcă să recupereze teren într-o piață în care rivalii au livrat deja actualizări importante, potrivit The Next Web . Koray Kavukcuoglu , noul șef al Google DeepMind, a spus că modelul este în „post-training” (etapa în care inginerii îi rafinează comportamentul și îi testează siguranța) și că Google vrea să îl lanseze „mult mai devreme” decât finalul anului. El nu a oferit o dată de lansare, dar a indicat intenția de a publica „cât mai curând posibil” o versiune timpurie rezultată după post-antrenare. În paralel, Gemini 4 este testat în Antigravity, un instrument de programare al Google. Prima lansare majoră sub noua conducere DeepMind Apariția publică a lui Kavukcuoglu a avut loc la conferința AI Agenda Live organizată de The Information, fiind prima sa intervenție în media de când a preluat conducerea operațională a DeepMind, după o reorganizare în august în care Demis Hassabis a renunțat la managementul de zi cu zi. În același context, publicația notează că cei doi co-lideri ai Gemini au demisionat în aceeași zi. Întrebat dacă Google a rămas în urmă, Kavukcuoglu a spus că are „cea mai mare încredere” în echipă și că, în opinia lui, este „o certitudine” că vor rămâne „în avangardă”. Presiunea competitivă: rivalii au „livrat” deja Miza accelerării ține de ritmul pieței. Articolul amintește că, în acest an, modelul „fanion” al Google a rămas în urmă față de variantele mai ieftine ale companiei: în iulie au apărut informații că următorul Gemini Pro ar fi întârziat cu luni, după ce rezultatele la programare nu au atins țintele interne, iar în august modelul Flash ajunsese cu două versiuni înaintea fanionului. În același timp, competiția a avansat: Anthropic a lansat Claude Opus 5.5 pe 22 septembrie, iar OpenAI a redus la jumătate prețurile GPT-6 odată cu modelele Sol și Luna, în aceeași zi. Pentru companii și dezvoltatori, un Gemini 4 lansat mai devreme ar putea schimba rapid opțiunile de implementare și costurile de utilizare, însă Google nu a comunicat încă o dată și nici detalii despre disponibilitate sau preț. [...]

Deși Amazon a investit 13 miliarde de dolari (aprox. 58,5 miliarde lei) în Anthropic, controlul companiei nu este dictat automat de investitori , pentru că guvernanța include un „ Long-Term Benefit Trust ” care poate numi majoritatea directorilor, potrivit BGR . Miza pentru piață: unul dintre cele mai finanțate laboratoare de inteligență artificială (care dezvoltă chatbotul Claude) funcționează cu o structură menită să limiteze presiunea comercială pe termen scurt, chiar în contextul unor pariuri de zeci de miliarde de dolari. Cine deține Anthropic și de ce nu e același lucru cu „cine conduce” Anthropic, companie privată fondată în 2021, are un acționariat larg, nu un singur proprietar. Printre investitorii menționați se numără Amazon și Alphabet, alături de fonduri și investitori instituționali precum GIC, Coatue, Sequoia Capital, Founders Fund, BlackRock, Blackstone și Fidelity. Fondatorii și angajații dețin, la rândul lor, acțiuni. Totuși, publicația subliniază că lista acționarilor nu spune automat cine „ține frâiele”: investitorii externi majori nu par să aibă control exclusiv asupra consiliului de administrație, iar structura de guvernanță oferă un rol decisiv unui organism separat. Structura „experimentală”: Long-Term Benefit Trust și statutul de Public Benefit Corporation Elementul central este Long-Term Benefit Trust, descris ca un organism independent creat pentru a proteja interesele Anthropic pe termen lung. Deși investitorii au reprezentare în board, Trust-ul are puterea de a numi majoritatea directorilor, ceea ce reduce posibilitatea ca direcția companiei să fie stabilită strict de finanțatori. Aranjamentul reflectă statutul Anthropic de Public Benefit Corporation (o formă juridică ce permite urmărirea unei misiuni de interes public în paralel cu interesele acționarilor). Anthropic descrie designul acestei structuri corporative drept „experimental” și susține că mecanismul este gândit să izoleze misiunea companiei de presiuni comerciale și ale acționarilor pe termen scurt. Pariul financiar: investiții uriașe, profituri încă limitate și presiune pe monetizare BGR notează că, în pofida profiturilor reduse de până acum, companiile mari continuă să parieze sume „colosale” pe jucători precum Anthropic, OpenAI și xAI (Elon Musk), în așteptarea unor randamente mari. Motivațiile includ poziționarea timpurie în cursa pentru modele avansate, acces la capacitate masivă de cloud și influență în definirea următoarei generații de servicii digitale. În paralel, finanțatorii se angajează la investiții de „zeci de miliarde de dolari” în infrastructură (cipuri și centre de date) necesară atât dezvoltării, cât și rulării sistemelor de inteligență artificială, un model diferit de finanțarea clasică de tip venture capital. Publicația avertizează însă că riscul este major: dacă cererea sau veniturile nu se materializează, investitorii și furnizorii de infrastructură pot rămâne expuși, iar companiile din domeniu sunt sub presiune să genereze profituri foarte mari pentru a justifica pariurile făcute. Context: creșterea vizibilității Claude și dezbaterea despre riscuri Claude, lansat în 2023, și-a crescut profilul ca chatbot de tip ChatGPT și ca „agent” pentru dezvoltare software și productivitate. Atenția asupra Anthropic a fost amplificată în septembrie 2026, după demisia unui cercetător, Jacob Coxon, care a avertizat că o parte a industriei crede că inteligența artificială ar putea „șterge” omenirea până la finalul deceniului dacă nu există garanții adecvate. În același context, șeful departamentului de „alignment science” (alinierea sistemelor de IA la obiective și valori umane), Evan Hubinger, a estimat o probabilitate de peste 10% ca IA să provoace extincția umană până în 2036. Pentru mediul de afaceri, combinația dintre finanțare masivă și o guvernanță care limitează controlul investitorilor ridică o întrebare practică: cine își asumă, în final, deciziile strategice într-o companie care atrage capital uriaș, dar încearcă să-și protejeze misiunea de presiunea randamentelor pe termen scurt. [...]

Bill Gates cere reglementări obligatorii pentru AI, avertizând că un „buton de urgență” nu ajunge , pe fondul temerilor că tehnologia ar putea fi folosită abuziv și ar scăpa de sub control, potrivit Biziday . Într-un interviu acordat duminică postului american NBC, Gates a spus că, dacă inteligența artificială nu este ținută sub control, ar putea cauza „un miliard de morți” și i-a criticat pe factorii de decizie pentru că nu tratează subiectul suficient de serios. El a cerut implicarea „forțelor de ordine și politicienilor” în stabilirea măsurilor de protecție, inclusiv prin monitorizare, pe care o vede ca obligatorie. „Avem nevoie ca forțele de ordine și politicienii să participe la discuția despre cum arată măsurile de protecție și monitorizarea. Și acesta trebuie să fie un lucru obligatoriu.” De ce „butonul de oprire” nu rezolvă problema, în viziunea lui Gates Gates a criticat ideea că riscurile AI pot fi gestionate doar printr-un mecanism de tip „kill switch” (buton de oprire de urgență), argumentând că discuția trădează, uneori, lipsa de familiaritate tehnică a unor decidenți. „Nu este suficient să ai un buton. Încă nu am ajuns în punctul în care… acestea preiau controlul asupra computerelor în mod autonom și nu pot fi oprite. Așadar, această discuție… arată, într-un fel, cât de puțin familiarizați cu aspectele tehnice sunt unii oameni.” El a mai avertizat asupra riscului ca AI să ajungă în „mâini răuvoitoare”, descriind combinația dintre actori cu intenții rele și cele mai noi instrumente AI drept o amenințare fără precedent. Context: o inițiativă legislativă respinsă și presiune din industrie Declarațiile vin după ce o inițiativă a guvernului american de a introduce o lege care ar fi obligat companiile de AI să implementeze „butoane de urgență” în modelele lor a fost respinsă, notează publicația, citând informații apărute în The Guardian și Politico . În paralel, mai mulți directori din tehnologie, inclusiv Sam Altman și Elon Musk, s-au alăturat apelurilor pentru încetinirea dezvoltării AI, pe fondul unor incidente în care agenți AI ar fi desfășurat acțiuni fără acord. Gates a reluat astfel semnale de alarmă exprimate și de alți experți, într-un moment în care, potrivit Biziday, el publicase în august și un eseu despre riscurile AI pentru securitatea globală (menționat de publicație aici ). [...]