Știri
Știri din categoria Inteligență artificială

Google își accelerează strategia de a reduce dependența de Nvidia prin discuții cu Marvell Technology pentru dezvoltarea a două cipuri dedicate inteligenței artificiale, într-un demers care ar putea influența costurile și capacitatea de livrare a Google Cloud, potrivit ITmedia.
Informația, atribuită de ITmedia publicației The Information, indică negocieri între Google (parte a Alphabet) și Marvell pentru a crea două componente noi menite să ruleze mai eficient modele de inteligență artificială. Miza este dublă: performanță mai bună pentru sarcini AI și o alternativă mai credibilă la plăcile grafice (GPU) Nvidia, care domină infrastructura de antrenare și inferență pentru AI.
Potrivit materialului, proiectul ar include:
ITmedia notează că Google lucrează de mai mult timp la poziționarea TPU ca alternativă viabilă la GPU-urile Nvidia folosite pe scară largă în industrie.
Articolul leagă direct această inițiativă de presiunea asupra Google de a demonstra investitorilor că investițiile în AI se transformă în rezultate comerciale. În acest context, vânzările de TPU sunt prezentate ca un factor important pentru creșterea veniturilor din Google Cloud.
Cu alte cuvinte, dacă Google reușește să-și întărească oferta de cipuri proprii (și ecosistemul din jurul lor), poate câștiga atât la nivel de costuri și disponibilitate a infrastructurii, cât și la nivel de diferențiere față de competitori care depind mai mult de Nvidia.
Conform informațiilor citate, cele două companii ar urmări ca proiectarea unității de procesare a memoriei să fie finalizată cel mai devreme anul viitor, după care ar urma livrarea pentru producție de test.
Materialul nu oferă detalii despre termeni comerciali, volume sau despre momentul în care noul TPU ar putea intra în producție.
Recomandate

Google extinde controlul vocal în Workspace , introducând trei funcții conversaționale care pot reduce timpul pierdut cu căutări și redactare în Gmail, Docs și Keep, potrivit Google . Noutatea are miză operațională pentru utilizatori și echipe: interacțiunea „hands-free” (fără tastatură) mută o parte din munca de căutare, structurare și redactare în fluxuri ghidate de modele audio Gemini. Ce se schimbă în Gmail, Docs și Keep Google lansează capabilități bazate pe „ Gemini Audio models ” (modele de inteligență artificială care înțeleg și generează vorbire), prezentate anterior în Workspace la I/O, iar acum disponibile ca funcții noi în trei aplicații. Gmail Live: căutare conversațională în inbox Gmail Live permite utilizatorilor să „întrebe” direct, pe voce, lucruri precum „Care este numărul porții de îmbarcare?” sau „Ce se întâmplă săptămâna aceasta la școala copilului?”, iar funcția scanează inboxul și returnează rapid răspunsuri, fără căutare manuală prin fire lungi de e-mailuri. Docs Live: redactare și structurare prin dialog Docs Live este poziționat ca „partener de idei” și coautor: utilizatorul vorbește, iar instrumentul organizează ideile și structurează documentul pentru a ajunge mai repede la o primă versiune. Google precizează că, „cu permisiunea” utilizatorului, Docs Live poate extrage detalii relevante din Gmail, Drive și Chat, dar și de pe web, pentru a completa contextul. Keep Live: transformă „brain dump” în notițe organizate În Keep, funcția vocală nouă preia un flux liber de idei și îl procesează „în fundal”, transformându-l în liste și notițe structurate, fără tastare. Disponibilitate și condiții de acces Funcțiile „conversaționale” încep să fie distribuite „săptămâna aceasta”, conform Google. Accesul este condiționat de tipul de abonament: Gmail Live și Keep Live : disponibile pentru abonații Google AI Plus, Pro și Ultra (detalii despre planuri: Google One – Google AI plans ). Docs Live : disponibil pentru abonații Pro și Ultra . Pentru clienții Google Workspace business , Google spune că funcțiile „vin în curând”, fără un calendar mai precis în material. Ce rămâne de urmărit pentru companii Pentru organizații, miza imediată este modul în care aceste funcții vor fi integrate în pachetele business și ce politici interne vor fi necesare pentru utilizarea extragerii de informații din e-mail și fișiere „cu permisiunea” utilizatorului. Google trimite la politica sa de confidențialitate pentru cadrul general: Google Privacy Policy . [...]

Google își extinde colaborarea cu MrBeast într-un parteneriat pe mai mulți ani, care mută utilizarea Gemini din zona de divertisment în demonstrații publice de utilizare practică și include și Google Health , potrivit Google Blog . În esență, Google își leagă produsele de un creator cu audiență uriașă pentru a arăta, în contexte „de teren”, cum poate fi folosită inteligența artificială generativă (AI care produce conținut și sugestii) în situații concrete. Parteneriatul este încheiat cu Beast Industries și „extinde relația dincolo de YouTube” către Gemini și Google Health. Google îl prezintă pe Jimmy Donaldson (MrBeast) drept „primul creator” care a atins 500 de milioane de abonați pe YouTube , iar colaborarea urmărește ca acesta să folosească Gemini pentru a-și executa concepte „mai sălbatice” și, în paralel, să arate cum Google Health poate sprijini obiective zilnice de fitness și stare de bine. Ce se vede prima dată: un clip pe 5 septembrie, cu Gemini folosit în scenarii extreme Primul material anunțat este un nou videoclip MrBeast programat pentru 5 septembrie, în care echipa încearcă să supraviețuiască în „unele dintre cele mai extreme și periculoase climate” de pe Pământ. Conform sursei, echipele vor concura în trei medii: junglă, deșert, Arctica, folosind Gemini pentru a identifica pericole, a face față schimbărilor brutale de vreme și a rămâne „cu un pas înainte”. Extinderea dincolo de YouTube: campanie Gemini și integrarea Fitbit Air Google mai spune că MrBeast va apărea într-un „nou lansat” (recent lansat) demers de promovare pentru Gemini, unde va arăta cum folosește aplicația ca partener pentru partea de logistică a cascadoriilor sale. În plus, compania precizează că Jimmy va integra „Fitbit Air” într-o provocare viitoare. Google nu oferă în material detalii financiare, termeni contractuali sau calendar complet al activărilor, dar descrie colaborarea drept începutul unui proiect mai amplu, cu noi apariții pe canalele MrBeast și pe conturile Gemini. [...]

AWS își securizează din timp capacitatea de calcul pentru AI printr-un plan de a adăuga încă 2 milioane de procesoare grafice (GPU) Nvidia în infrastructura sa globală între 2027 și 2028, potrivit TechRadar . Mișcarea indică o accelerare a investițiilor în centre de date, pe fondul unei cereri pentru „accelerated computing” (calcul accelerat, adică folosirea GPU-urilor pentru sarcini AI) care, conform companiilor, a depășit așteptările. Planul vine după un angajament anterior de a adăuga peste un milion de cipuri începând din 2026, pe măsură ce cererea clienților a crescut mai repede decât estimările. Extinderea consolidează parteneriatul de lungă durată dintre Amazon Web Services (AWS) și Nvidia și sugerează că ambele companii mizează pe continuarea creșterii cheltuielilor pentru inteligență artificială. Ce include extinderea, dincolo de GPU-uri Pe lângă cele 2 milioane de GPU-uri, AWS și Nvidia își extind colaborarea și pe alte componente ale infrastructurii: introducerea unor noi procesoare „Vera-based” (CPU-uri) în cloud-ul Amazon, pentru aplicații AI mai solicitante; modernizări de rețea, inclusiv extinderea tehnologiei NVLink Fusion , împreună cu memorie cu lățime mare de bandă, pentru performanță mai bună în clustere mari; actualizări pentru serviciile de analiză ale Amazon folosind software-ul Nvidia cuDF, cu viteze de procesare „aproape de 3,7 ori” față de configurații standard și o îmbunătățire de „aprox. 30%” a raportului preț/performanță față de setări bazate doar pe cipuri standard; îmbunătățiri la căutarea vectorială (tehnică folosită frecvent în AI pentru a găsi similarități), unde construirea indexului ar fi de „aprox. 9 ori” mai rapidă când rulează pe GPU-uri. Separat, divizia de robotică a Amazon lucrează cu Nvidia la instrumente de simulare pentru a accelera antrenarea roboților de depozit de generație următoare. Componentă de securitate și sector public În plan este inclusă și o alocare dedicată pentru sectorul public: 100.000 de cipuri ar urma să fie rezervate pentru nevoi sensibile de calcul ale agențiilor guvernamentale și de apărare din SUA, potrivit materialului. Ce spun companiile și care este incertitudinea CEO-ul AWS, Matt Garman, a spus că utilizatorii vor „libertatea de a alege cele mai bune instrumente” pentru sarcinile AI și încrederea că acestea funcționează integrat, motiv pentru care AWS a investit împreună cu Nvidia în optimizări de la rețea și securitate până la implementare. La rândul său, Jensen Huang, CEO Nvidia, a afirmat că „cererea este înaintea fiecărei prognoze” și că parteneriatul se extinde „pe întregul stack” (GPU-uri, CPU-uri, rețelistică, modele deschise și software) pentru a face „agentic și physical AI” (AI care poate acționa autonom și AI integrată în sisteme fizice) scalabile în cloud. TechRadar notează însă și limita evidentă a unui astfel de pariu: dacă cererea reală va ține pasul cu planurile va deveni limpede abia după ce noua infrastructură va fi operațională. [...]

Un judecător federal din SUA a sugerat că „ AI Overviews ” poate crea o piață nouă pentru „inputurile” IA și poate ridica probleme antitrust , într-o audiere în care a criticat dur felul în care Google folosește conținutul presei pentru răspunsurile generate de inteligență artificială, potrivit Ziarul Financiar . Audierea a avut loc săptămâna trecută la tribunalul federal din Washington și a fost condusă de judecătorul Amit Mehta , cel care a decis în august 2024 că Google deține un monopol ilegal pe piața căutării online. De această dată, discuția s-a concentrat pe „AI Overviews”, funcția care afișează rezumate generate de IA deasupra rezultatelor clasice de căutare. În timpul audierilor, Mehta a spus că Google „aspiră” conținutul editorilor pentru a-și rafina rezultatele bazate pe IA „într-un mod care pare cu adevărat nedrept” și a avertizat că îmbunătățirile de produs nu sunt „complet imune” la controlul antitrust, potrivit relatării publicației juridice MLex, citată de ZF. Două procese consolidate, aceeași acuzație: efectul asupra presei Instanța a analizat cererile Google de respingere a două procese antitrust, consolidate pentru această audiere: procesul intentat în septembrie 2025 de Penske Media (editor al unor titluri precum Rolling Stone, Variety, Billboard, The Hollywood Reporter și Deadline); procesul deschis în februarie 2025 de compania de educație online Chegg. Ambele vizează efectele „AI Overviews” și modul în care rezumatele generate de IA folosesc conținutul editorilor. Linia de apărare a Google și reacția judecătorului Avocații Google au susținut că „AI Overviews” este o „îmbunătățire de produs” și au descris relația istorică dintre Google și editori — în care editorii permit scanarea conținutului, iar motorul de căutare trimite trafic — drept „un istoric vag de relații comerciale”, potrivit lui Jason Kint, directorul general al Digital Content Next (DCN), asociația editorilor premium americani, prezent la audiere. În versiunea companiei, riscul ca modelul să lovească presa ar fi „mult prea speculativ”. Judecătorul Mehta nu a părut convins și a replicat că situația, în ansamblu, „pare, toată, cu adevărat nedreaptă”, potrivit lui Kint. Acesta a mai relatat că judecătorul a considerat că „îmbunătățirea de produs” invocată de Google ar fi fost construită „pe spinarea editorilor”, care nu au control asupra felului în care compania le folosește conținutul. Avocatul Penske a rezumat dezechilibrul astfel: editorii, „în cea mai mare parte, nu pot spune nu”. De ce contează: semnalul antitrust despre o „piață” a inputurilor pentru IA Un element cu potențial impact de reglementare este observația judecătorului că „se formează clar o piață” pentru inputurile inteligenței artificiale generative — adică pentru conținutul și datele folosite pentru a produce răspunsuri IA. Potrivit relatării DCN, Mehta a sugerat și că situația ar semăna, în anumite privințe, cu o „facilitate esențială” (infrastructură de care depinde o întreagă piață), dar a precizat că nu îi revine, în acest stadiu, să facă o asemenea calificare. Ce urmează depinde de modul în care instanța va trata cererile de respingere și de felul în care va interpreta, în cheie antitrust, relația dintre un produs IA integrat în căutare și dependența editorilor de distribuția prin Google. [...]

Un leak de cod pentru DLSS 5 riscă să împingă „neural rendering” în jocuri fără controlul Nvidia , cu efecte vizuale aplicate prin moduri neoficiale și cu penalizări vizibile de performanță, potrivit The Verge . Conform publicației, modderi testează o versiune neoficială a DLSS 5 (tehnologia Nvidia de upscaling și randare asistată de inteligență artificială) în titluri precum Skyrim , Cyberpunk 2077 , GTA V și altele, după ce cod asociat funcției a apărut într-un build de acces timpuriu al NBA 2K27 . Membri ai canalului de modding RenoDX de pe Discord ar fi extras fișierul de „Neural Rendering” și l-au aplicat inițial în Control , înainte ca experimentul să se extindă. Ce se schimbă în imagine și de ce e controversat În demonstrații video descrise de The Verge, ajustarea setărilor DLSS 5 poate modifica vizibil trăsăturile feței personajelor și iluminarea, cu rezultate care variază de la „mai multă definiție” la un aspect perceput de unii jucători ca un filtru artificial. În GTA: San Andreas , de exemplu, efectul pare să aplice un fel de „filtru” pe fața personajului CJ, să accentueze texturile și umbrele și să schimbe tonul iluminării pe măsură ce sunt mișcate anumite glisoare. Reacțiile sunt împărțite: unii consideră că filtrele îmbunătățesc imaginea, alții le critică drept „AI slop” și spun că rezultatul seamănă cu un filtru de „îmbunătățire” aplicat peste imagini, nu cu direcția artistică originală. Impact operațional: cost de performanță și consum de memorie video Dincolo de aspect, modderii spun că efectele au un cost. Un utilizator care a încercat mod-ul în Final Fantasy VII Rebirth susține că numărul de cadre pe secundă (FPS) i s-a înjumătățit și că schimbarea presetărilor consumă „o tonă” de memorie video (VRAM). Într-un alt exemplu, într-un clip din GTA V , FPS-ul ar scădea de la 90 la 29 în timpul ajustării setărilor. În plus, deși varianta neoficială ar fi rulat inițial pe plăci RTX din seria 50, ulterior ar fi fost pusă în funcțiune și pe RTX 4090 și RTX 4080, potrivit VideoCardz (citat de The Verge). Context: DLSS 5 urmează să fie lansat oficial în toamnă Nvidia a anunțat DLSS 5 în martie, ca tehnologie care folosește inteligență artificială pentru „iluminare și materiale fotorealiste” în timp real. Demonstrațiile inițiale au generat reacții negative, inclusiv critici că personajele capătă un aspect generic; CEO-ul Nvidia, Jensen Huang , a răspuns atunci că instrumentul „nu schimbă controlul artistic”. Lansarea oficială a DLSS 5 este programată pentru această toamnă. Pentru Nvidia, apariția unei versiuni neoficiale în mâinile comunității de modding ridică o problemă practică: tehnologia ajunge să fie judecată în public pe baza unor implementări necontrolate, cu rezultate vizuale și de performanță care pot varia puternic de la un joc la altul și de la un sistem la altul. [...]

AWS își extinde masiv capacitatea de calcul pentru AI printr-un plan de a adăuga 2 milioane de GPU-uri NVIDIA în 2027–2028 , într-o mișcare care vizează direct blocajul de infrastructură pe fondul trecerii accelerate a clienților de la proiecte-pilot la producție, potrivit NVIDIA News . Extinderea face parte dintr-o colaborare mai amplă AWS–NVIDIA, care acoperă nu doar GPU-uri, ci și procesoare, rețelistică, modele deschise și tehnologii pentru robotică. Planul vine după ce AWS a anunțat la NVIDIA GTC 2026 intenția de a adăuga peste 1 milion de GPU-uri începând din 2026, însă cererea ar fi depășit estimările inițiale. Conform sursei, noile livrări ar include GPU-uri din generațiile NVIDIA Blackwell Ultra, Rubin și Rubin Ultra, integrate în infrastructura globală AWS, inclusiv în „fabrici de AI” (centre de date optimizate pentru antrenarea și rularea modelelor). Ce se schimbă operațional: mai multă capacitate și integrare pe „întregul stack” AI Dincolo de volum, colaborarea urmărește să reducă fricțiunile de implementare pentru clienți, prin integrarea mai strânsă între componentele NVIDIA și serviciile AWS. În lista de inițiative menționate se regăsesc: implementarea a 2 milioane de GPU-uri NVIDIA suplimentare în infrastructura AWS în 2027–2028 ; aducerea pe AWS a infrastructurii bazate pe NVIDIA Vera (CPU), ca opțiune pentru sarcini de tip „agentic AI” (sisteme care pot planifica și executa acțiuni în lanț, nu doar genera răspunsuri); extinderea NVLink Fusion și colaborarea pe o memorie cu lățime mare de bandă, NVHBM (high-bandwidth memory personalizată), în contextul interoperabilității cu cipurile Trainium ale AWS; integrarea platformei NVIDIA cu AWS Nitro System și Elastic Fabric Adapter (EFA) , pentru securitate, fiabilitate și conectivitate în clustere mari; continuarea suportului pentru modelele deschise NVIDIA Nemotron în Amazon Bedrock și Amazon SageMaker; accelerarea procesării de date și a indexării vectoriale (operațiuni-cheie pentru căutare semantică și aplicații cu baze de date vectoriale) pe Amazon EMR și Amazon OpenSearch, cu biblioteci NVIDIA. Performanță și cost: ce cifre invocă AWS și NVIDIA Sursa indică mai multe repere de performanță, relevante pentru companiile care urmăresc costul de rulare (inferență) și viteza de procesare: pentru instanțele Amazon EC2 G7 , AWS menționează 4,6 ori performanță mai mare la inferență AI și 2,1 ori performanță grafică față de generația G6; AWS afirmă că este primul furnizor major de cloud care oferă instanțe accelerate de RTX PRO 4500 Blackwell ; pentru procesarea de date pe Amazon EMR cu instanțe G7 și biblioteca NVIDIA cuDF , colaborarea ar livra până la 3,7 ori procesare mai rapidă și o îmbunătățire de 30% a raportului preț/performanță față de configurații bazate pe CPU; pentru indexarea vectorială accelerată pe GPU în Amazon OpenSearch Service, este menționată o viteză de până la 9 ori mai mare, la un sfert din cost , prin mutarea construcției indexului pe GPU-uri dedicate. Componenta guvernamentală: „fabrici de AI” pentru SUA și 100.000 de GPU-uri Un element distinct al planului este orientarea către sectorul public american: AWS și NVIDIA spun că vor construi „fabrici de AI” pentru guvernul SUA și au în plan livrarea a 100.000 de GPU-uri pe infrastructură AWS securizată, pentru sarcini federale și de securitate națională. Sursa menționează rularea de sarcini clasificate la Impact Level 6 (IL6) și peste . De ce contează În termeni de piață, anunțul semnalează că AWS mizează pe extinderea agresivă a ofertei de calcul accelerat pentru a susține valul de cerere pentru AI „agentic” și „fizic” (robotică), într-un moment în care capacitatea de GPU a devenit un factor limitativ pentru multe organizații. În același timp, accentul pe integrare (Nitro/EFA, modele, pipeline-uri de date, rețelistică) sugerează o competiție care nu se mai poartă doar la nivel de „câte GPU-uri ai”, ci și la cât de repede pot clienții să treacă în producție și să opereze la scară, cu costuri controlabile. [...]