Știri
Știri din categoria Inteligență artificială

NVIDIA și partenerii săi au deschis ca standard MRC, un protocol care crește reziliența rețelelor pentru antrenarea AI la scară foarte mare, după ce a fost folosit în producție pe infrastructura Spectrum‑X, potrivit NVIDIA. Miza este una operațională: în clustere cu mii de GPU-uri, întreruperile sau congestia de rețea pot încetini ori opri antrenări lungi și costisitoare, iar MRC este proiectat să reducă aceste blocaje prin rutare pe mai multe căi și recuperare rapidă la pierderi de pachete.
MRC (Multipath Reliable Connection) este descris ca un protocol de transport RDMA (Remote Direct Memory Access – tehnologie care permite transferuri de date cu latență mică, ocolind o parte din procesarea clasică a sistemului de operare). Concret, MRC permite ca o singură conexiune RDMA să distribuie traficul pe mai multe rute din rețea, cu efecte urmărite direct în exploatare:
NVIDIA susține că MRC ajută la menținerea unui nivel ridicat de utilizare a GPU-urilor, tocmai prin faptul că „ține” lățimea de bandă necesară pe durata antrenării și reduce timpii morți generați de problemele de rețea.
În arhitectura descrisă, MRC folosește mecanisme care vizează două tipuri de incidente frecvente la scară mare: congestia și pierderile de date.
Pe congestie, protocolul ar evita dinamic rutele supraîncărcate „în timp real”, pentru a susține lățime de bandă ridicată chiar și când rețeaua este aglomerată. La pierderi de date, NVIDIA indică o retransmisie „rapidă și precisă”, menită să limiteze efectul întreruperilor scurte asupra joburilor de lungă durată.
Un element cheie este „failure bypass”: tehnologia ar detecta o cădere de rută și ar reruta traficul automat, în hardware, „în doar microsecunde” — un detaliu relevant pentru antrenarea distribuită, unde sincronizarea între mii de GPU-uri este sensibilă la întreruperi.
NVIDIA indică drept utilizatori ai Spectrum‑X Ethernet (în acest context) OpenAI, Microsoft și Oracle. În plus, compania afirmă că centrele de date Microsoft Fairwater și Oracle Cloud Infrastructure (OCI) Abilene se bazează pe MRC pentru cerințe de performanță, scalare și eficiență.
Un punct cu impact de industrie este că MRC, după utilizarea în producție cu performanță optimizată pe hardware Spectrum‑X, a fost „lansat ca specificație deschisă” prin Open Compute Project (OCP) — o mișcare care, în mod tipic, facilitează adoptarea mai largă și interoperabilitatea între furnizori.
NVIDIA mai precizează că a colaborat la dezvoltarea MRC cu AMD, Broadcom, Intel, Microsoft și OpenAI.
„Implementarea MRC în generația Blackwell a avut mult succes și a fost posibilă datorită unei colaborări puternice cu NVIDIA”, a declarat Sachin Katti, șeful diviziei de industrial compute la OpenAI. „Abordarea end‑to‑end a MRC ne-a permis să evităm o mare parte din încetinirile și întreruperile tipice legate de rețea și să menținem eficiența antrenărilor de frontieră la scară.”
Pe Spectrum‑X Ethernet, clienții ar avea opțiuni de modele de transport RDMA: atât Adaptive RDMA, cât și MRC, plus alte protocoale personalizate, care rulează nativ pe NVIDIA ConnectX SuperNICs și switch-urile Spectrum‑X și susțin designuri de rețea „multiplanar”.
În această arhitectură, o rețea multiplanară înseamnă mai multe „plane” (fabrice) independente, fiecare oferind rute alternative între GPU-uri. NVIDIA afirmă că funcția Spectrum‑X Multiplane adaugă echilibrare de sarcină accelerată în hardware între plane, pentru reziliență și scalare, menținând latențe predictibile și permițând extinderea la „sute de mii de GPU-uri”.
Pentru piață, mesajul operațional este că, pe măsură ce infrastructura de antrenare AI crește, diferențiatorul nu mai este doar viteza brută, ci capacitatea rețelei de a evita congestia și de a „supraviețui” defectelor fără a opri joburile — iar standardizarea deschisă a MRC urmărește să transforme aceste mecanisme într-o practică mai ușor de adoptat la scară.
Recomandate

OpenAI își retrage modelele din Cursor după preluarea de către SpaceX , invocând riscuri de conformitate și istoricul de încălcare a contractelor în companiile controlate de Elon Musk, potrivit OpenAI . Compania spune că a notificat SpaceX că intenționează să închidă contractul prin care furniza modele OpenAI către Cursor, cu o dată propusă de oprire pe 12 noiembrie 2026. Decizia are un impact operațional direct pentru dezvoltatorii care folosesc Cursor cu modele OpenAI: accesul prin această integrare urmează să fie retras, iar OpenAI afirmă că oferă „notificarea maximă” permisă de contract pentru a prelungi cât mai mult perioada în care utilizatorii pot rămâne conectați la modelele sale. De ce taie OpenAI accesul: „nu putem avea încredere” în respectarea termenilor OpenAI își justifică decizia prin faptul că „nu poate fi încrezătoare” că SpaceX va utiliza tehnologia în limitele termenilor de utilizare, pe baza experienței anterioare cu companii ale lui Musk care ar fi încălcat contracte. În text sunt menționate două repere: după ce Musk a achiziționat Twitter (acum parte din SpaceX), compania ar fi încălcat termenii contractului cu OpenAI, conform relatării din The New York Times (link în sursă); „sub jurământ”, Musk ar fi admis că xAI (acum, de asemenea, parte din SpaceX) a încălcat termenii de utilizare ai OpenAI, potrivit Forbes (link în sursă). Fereastra contractuală și miza „ Astra ” OpenAI precizează că acordul personalizat cu Cursor îi oferă o fereastră limitată pentru anulare după o schimbare de control, ceea ce explică de ce oprirea este programată la o dată ulterioară notificării. În același timp, compania leagă decizia de responsabilitatea sporită pe măsură ce capabilitățile AI avansează și de necesitatea de a se asigura că viitorul său model, „Astra”, este folosit conform termenilor. În acest context, OpenAI spune că va menține anularea la „cea mai târzie dată” posibilă, dar fără a furniza „modele viitoare” către Cursor. Ce urmează pentru utilizatori OpenAI afirmă că a lucrat cu Cursor aproape patru ani și că respectă echipa și produsul, însă recunoaște că cei mai afectați vor fi dezvoltatorii care se bazează pe modelele OpenAI în Cursor. Compania susține că este pregătită să ofere sprijin în tranziție, fără să detalieze în material ce formă va lua acest suport sau ce alternative concrete vor avea utilizatorii după 12 noiembrie 2026. [...]

Un leak de cod pentru DLSS 5 riscă să împingă „neural rendering” în jocuri fără controlul Nvidia , cu efecte vizuale aplicate prin moduri neoficiale și cu penalizări vizibile de performanță, potrivit The Verge . Conform publicației, modderi testează o versiune neoficială a DLSS 5 (tehnologia Nvidia de upscaling și randare asistată de inteligență artificială) în titluri precum Skyrim , Cyberpunk 2077 , GTA V și altele, după ce cod asociat funcției a apărut într-un build de acces timpuriu al NBA 2K27 . Membri ai canalului de modding RenoDX de pe Discord ar fi extras fișierul de „Neural Rendering” și l-au aplicat inițial în Control , înainte ca experimentul să se extindă. Ce se schimbă în imagine și de ce e controversat În demonstrații video descrise de The Verge, ajustarea setărilor DLSS 5 poate modifica vizibil trăsăturile feței personajelor și iluminarea, cu rezultate care variază de la „mai multă definiție” la un aspect perceput de unii jucători ca un filtru artificial. În GTA: San Andreas , de exemplu, efectul pare să aplice un fel de „filtru” pe fața personajului CJ, să accentueze texturile și umbrele și să schimbe tonul iluminării pe măsură ce sunt mișcate anumite glisoare. Reacțiile sunt împărțite: unii consideră că filtrele îmbunătățesc imaginea, alții le critică drept „AI slop” și spun că rezultatul seamănă cu un filtru de „îmbunătățire” aplicat peste imagini, nu cu direcția artistică originală. Impact operațional: cost de performanță și consum de memorie video Dincolo de aspect, modderii spun că efectele au un cost. Un utilizator care a încercat mod-ul în Final Fantasy VII Rebirth susține că numărul de cadre pe secundă (FPS) i s-a înjumătățit și că schimbarea presetărilor consumă „o tonă” de memorie video (VRAM). Într-un alt exemplu, într-un clip din GTA V , FPS-ul ar scădea de la 90 la 29 în timpul ajustării setărilor. În plus, deși varianta neoficială ar fi rulat inițial pe plăci RTX din seria 50, ulterior ar fi fost pusă în funcțiune și pe RTX 4090 și RTX 4080, potrivit VideoCardz (citat de The Verge). Context: DLSS 5 urmează să fie lansat oficial în toamnă Nvidia a anunțat DLSS 5 în martie, ca tehnologie care folosește inteligență artificială pentru „iluminare și materiale fotorealiste” în timp real. Demonstrațiile inițiale au generat reacții negative, inclusiv critici că personajele capătă un aspect generic; CEO-ul Nvidia, Jensen Huang , a răspuns atunci că instrumentul „nu schimbă controlul artistic”. Lansarea oficială a DLSS 5 este programată pentru această toamnă. Pentru Nvidia, apariția unei versiuni neoficiale în mâinile comunității de modding ridică o problemă practică: tehnologia ajunge să fie judecată în public pe baza unor implementări necontrolate, cu rezultate vizuale și de performanță care pot varia puternic de la un joc la altul și de la un sistem la altul. [...]

AWS își extinde masiv capacitatea de calcul pentru AI printr-un plan de a adăuga 2 milioane de GPU-uri NVIDIA în 2027–2028 , într-o mișcare care vizează direct blocajul de infrastructură pe fondul trecerii accelerate a clienților de la proiecte-pilot la producție, potrivit NVIDIA News . Extinderea face parte dintr-o colaborare mai amplă AWS–NVIDIA, care acoperă nu doar GPU-uri, ci și procesoare, rețelistică, modele deschise și tehnologii pentru robotică. Planul vine după ce AWS a anunțat la NVIDIA GTC 2026 intenția de a adăuga peste 1 milion de GPU-uri începând din 2026, însă cererea ar fi depășit estimările inițiale. Conform sursei, noile livrări ar include GPU-uri din generațiile NVIDIA Blackwell Ultra, Rubin și Rubin Ultra, integrate în infrastructura globală AWS, inclusiv în „fabrici de AI” (centre de date optimizate pentru antrenarea și rularea modelelor). Ce se schimbă operațional: mai multă capacitate și integrare pe „întregul stack” AI Dincolo de volum, colaborarea urmărește să reducă fricțiunile de implementare pentru clienți, prin integrarea mai strânsă între componentele NVIDIA și serviciile AWS. În lista de inițiative menționate se regăsesc: implementarea a 2 milioane de GPU-uri NVIDIA suplimentare în infrastructura AWS în 2027–2028 ; aducerea pe AWS a infrastructurii bazate pe NVIDIA Vera (CPU), ca opțiune pentru sarcini de tip „agentic AI” (sisteme care pot planifica și executa acțiuni în lanț, nu doar genera răspunsuri); extinderea NVLink Fusion și colaborarea pe o memorie cu lățime mare de bandă, NVHBM (high-bandwidth memory personalizată), în contextul interoperabilității cu cipurile Trainium ale AWS; integrarea platformei NVIDIA cu AWS Nitro System și Elastic Fabric Adapter (EFA) , pentru securitate, fiabilitate și conectivitate în clustere mari; continuarea suportului pentru modelele deschise NVIDIA Nemotron în Amazon Bedrock și Amazon SageMaker; accelerarea procesării de date și a indexării vectoriale (operațiuni-cheie pentru căutare semantică și aplicații cu baze de date vectoriale) pe Amazon EMR și Amazon OpenSearch, cu biblioteci NVIDIA. Performanță și cost: ce cifre invocă AWS și NVIDIA Sursa indică mai multe repere de performanță, relevante pentru companiile care urmăresc costul de rulare (inferență) și viteza de procesare: pentru instanțele Amazon EC2 G7 , AWS menționează 4,6 ori performanță mai mare la inferență AI și 2,1 ori performanță grafică față de generația G6; AWS afirmă că este primul furnizor major de cloud care oferă instanțe accelerate de RTX PRO 4500 Blackwell ; pentru procesarea de date pe Amazon EMR cu instanțe G7 și biblioteca NVIDIA cuDF , colaborarea ar livra până la 3,7 ori procesare mai rapidă și o îmbunătățire de 30% a raportului preț/performanță față de configurații bazate pe CPU; pentru indexarea vectorială accelerată pe GPU în Amazon OpenSearch Service, este menționată o viteză de până la 9 ori mai mare, la un sfert din cost , prin mutarea construcției indexului pe GPU-uri dedicate. Componenta guvernamentală: „fabrici de AI” pentru SUA și 100.000 de GPU-uri Un element distinct al planului este orientarea către sectorul public american: AWS și NVIDIA spun că vor construi „fabrici de AI” pentru guvernul SUA și au în plan livrarea a 100.000 de GPU-uri pe infrastructură AWS securizată, pentru sarcini federale și de securitate națională. Sursa menționează rularea de sarcini clasificate la Impact Level 6 (IL6) și peste . De ce contează În termeni de piață, anunțul semnalează că AWS mizează pe extinderea agresivă a ofertei de calcul accelerat pentru a susține valul de cerere pentru AI „agentic” și „fizic” (robotică), într-un moment în care capacitatea de GPU a devenit un factor limitativ pentru multe organizații. În același timp, accentul pe integrare (Nitro/EFA, modele, pipeline-uri de date, rețelistică) sugerează o competiție care nu se mai poartă doar la nivel de „câte GPU-uri ai”, ci și la cât de repede pot clienții să treacă în producție și să opereze la scară, cu costuri controlabile. [...]

Huawei a ofertat să construiască centrele de date pentru AI ale Egiptului, iar SUA încearcă să blocheze proiectul printr-un consorțiu rival , într-un episod care transformă o licitație tehnologică într-un test de reglementare și influență geopolitică, potrivit The Next Web . Oferta Huawei vizează livrarea a 1.408 cipuri Ascend din seria 950 pentru un „cloud” de antrenare AI și încă 600 de cipuri (aceeași serie sau modelul mai vechi 910B) pentru două clustere de inferență (rulare a modelelor). Compania propune un calendar de construcție de 12 luni. Informațiile au fost relatate de Bloomberg , pe baza unor persoane familiarizate cu discuțiile și a unor documente consultate. De ce contează: licențele SUA pot decide proiectul Miza imediată nu este volumul livrărilor, ci cadrul de control al exporturilor. Conform materialului, transporturile de cipuri AI către Egipt au nevoie de aprobarea SUA din 2023, iar Egiptul este unul dintre aproximativ 40 de state aflate în această categorie. Asta oferă Washingtonului pârghie prin procesul de licențiere. În paralel, SUA au transmis că utilizarea anumitor acceleratoare Huawei fără aprobare poate atrage sancțiuni legale. Nu este clar dacă oficialii americani au ridicat explicit această problemă în discuțiile cu Cairo. Răspunsul Washingtonului: consorțiu cu Nvidia, AMD și Microsoft După ce administrația Trump ar fi aflat de propunerea Huawei, Departamentul de Stat a contactat Nvidia, AMD și Microsoft pentru o contraofertă. Microsoft a refuzat să comenteze, iar Nvidia și AMD nu au răspuns solicitărilor, potrivit aceleiași surse. Un purtător de cuvânt al Departamentului de Stat a declarat că SUA discută cu „zeci de țări” despre „leadership-ul tehnologic” american în AI și că sunt „pregătite să colaboreze” în moduri care „respectă suveranitatea”. Bloomberg notează însă că nu este clar ce ar include propunerea americană și nici dacă Washingtonul ar impune restricții privind utilizările tehnologiei livrate. Ce include oferta Huawei: parteneriat cu iFlytek și aplicații de supraveghere Documentele descrise în material indică un parteneriat cu iFlytek, companie chineză de recunoaștere vocală și supraveghere; atât Huawei, cât și iFlytek sunt pe lista neagră a SUA din 2019. Oferta ar include: recunoaștere de vehicule și persoane, corelată cu o bază națională de date a populației; „situațional awareness” (monitorizare operațională), descrisă ca „o vedere panoramică a orașului pe un singur ecran”. Prezentarea ar avea 102 pagini, iar pe un slide apar exemple pentru „aplicații video de bază” cu însemnele Ministerului chinez al Securității Publice. Huawei a refuzat să comenteze, iar iFlytek nu a răspuns; Ministerul de Externe al Egiptului nu a răspuns întrebărilor Bloomberg. Context: Egiptul între China și SUA, cu o strategie AI ambițioasă Egiptul are peste 100 de milioane de locuitori și și-a intensificat relațiile cu China, inclusiv în comerț și exerciții militare. Xi Jinping urmează să viziteze țara săptămâna viitoare, prima vizită în peste un deceniu. A doua strategie națională de AI a Egiptului țintește o contribuție de 7,7% la PIB până în 2030, dar țara nu produce cipuri, ceea ce o lasă, practic, între furnizori americani și chinezi. În același timp, materialul notează că firmele americane de infrastructură nu au tratat istoric Egiptul ca piață, în timp ce Huawei este prezentă acolo de decenii. Ce urmează Egiptul nu a indicat ce ofertă preferă și nu există o dată confirmată pentru decizie. Bloomberg apreciază că licitația ar putea fi prima competiție directă SUA–China pentru un proiect guvernamental de AI. Un element-cheie de urmărit este dacă un consorțiu american se materializează înainte de vizita lui Xi, întrucât nu există confirmări că Nvidia, AMD sau Microsoft au acceptat să participe. [...]

Un posibil prim caz documentat de civili uciși de o dronă cu țintire automată ridică presiunea pentru reguli mai stricte privind armele autonome , pe fondul folosirii tot mai frecvente a inteligenței artificiale pe câmpul de luptă, potrivit G4Media . Publicația relatează că o dronă rusească pilotată complet de IA ar fi lovit autonom o benzinărie din Zaporijia, pe 6 iulie, ucigând trei ucraineni. Informația este prezentată ca o premieră îngrijorătoare în războiul Rusia–Ucraina: ar putea fi primul caz documentat în care civili sunt uciși de o dronă echipată cu un sistem automat de țintire. Potrivit materialului, cazul a fost relatat în detaliu de The New York Times , iar concluzia privind caracterul „documentat” este atribuită lui Kateryna Bondar, cercetătoare principală la Centrul Wadhwani pentru IA din cadrul Centrului pentru Studii Strategice și Internaționale din Washington. Ce indică datele tehnice invocate în relatare Pentru a susține evaluarea, oficiali ucraineni ar fi prezentat jurnaliștilor resturi de la două drone rusești Molniya. The New York Times ar fi fotografiat un modul de computer Nvidia de la bord și ar fi trimis imaginile companiei, care a confirmat că fotografiile arată un mini-computer Jetson Orin. În relatare se precizează că cipul folosit în atacul de la Zaporijia „nu era criptat” și că astfel de module, care „costă doar câteva sute de dolari”, au fost găsite pe mai multe tipuri de arme rusești. Nvidia a transmis, într-un comunicat citat de G4Media, că produsul este unul de consum, „destinat studenților, dezvoltatorilor și startup-urilor”, și că firma îl vinde în multe țări, dar nu și în Rusia, deși este „disponibil pe scară largă la comercianții cu amănuntul”. De ce contează: riscul de erori și încălcări ale legilor războiului Materialul notează că dronele autonome ghidate de IA nu necesită pilot uman, ceea ce le poate face mai greu de contracarat într-un context în care operatorii de drone au devenit ținte principale. În același timp, fără intervenție umană, astfel de sisteme sunt descrise ca fiind mai predispuse la erori dramatice sau la încălcarea legilor războiului, inclusiv prin incapacitatea de a distinge între civili și combatanți. Organizații pentru drepturile omului și Comitetul Internațional al Crucii Roșii sunt menționate ca avertizând asupra riscurilor și consecințelor și ca opunându-se utilizării armelor echipate cu inteligență artificială fără intervenție umană. Context operațional: testare și perfecționare pe front Potrivit sursei, Rusia ar fi vizat în timpul testelor infrastructură civilă (pompe de benzină și rezervoare de propan de la stații de benzină) și centre de recrutare militară în Zaporijia, însă motivele alegerii acestor ținte „rămân neclare”. Vadim Kușnikov, expert în drone la Institutul de Aviație din Harkiv, este citat afirmând că drona implicată era „un instrument preprogramat, antrenat în realitatea virtuală pentru a urmări obiecte specifice”. Colonelul Minaiev, comandant al apărării aeriene a orașului, spune că tehnologia este eficientă, dar încă imperfectă, adăugând: „Ei perfecționează această tehnologie. Ei identifică erorile și le corectează.” În același context, articolul menționează că Rusia a început zboruri de testare ale dronelor Molniya ghidate de IA în luna mai a anului trecut și că, anterior, ar fi testat sisteme de auto-țintire pe o altă dronă cu aripi fixe, V2U, potrivit experților ucraineni în apărare aeriană. Nu doar Rusia: și Ucraina a testat sisteme autonome G4Media mai notează că Ucraina a testat, la rândul ei, sisteme automate de țintire cu inteligență artificială. Fostul ministru al apărării, Mihailo Fedorov (recent demis), este citat spunând într-un interviu acordat The New York Times că Ucraina a folosit anterior un sistem complet autonom în Crimeea, vizând depozite de combustibil și echipamente militare, fără victime civile. În lipsa unor concluzii oficiale independente prezentate în material, relatarea rămâne formulată cu prudență („ar fi”, „ar putea fi”), însă miza este una de reglementare: dacă astfel de cazuri se confirmă și se repetă, presiunea pentru limitarea sau interzicerea armelor autonome fără control uman va crește. [...]

NVIDIA Groq 3 LPX a intrat în producție de serie, iar miza este accelerarea inferenței AI pentru „agenți” care trebuie să genereze rapid volume mari de text și să răspundă cu latență foarte mică, potrivit NVIDIA News . Compania poziționează noul accelerator ca extensie a platformei Vera Rubin, cu accent pe creșterea ratei de generare a „tokenurilor” (unități de text procesate de modele) în sarcini sensibile la întârziere, precum programarea asistată de AI. În testele de tip benchmarking realizate de Artificial Analysis, Groq 3 LPX a atins un record de 3.400 tokenuri de ieșire pe secundă, rulând Gemma 4 31B, un model „agentic” open-source, cu un context de 100.000 de tokenuri. NVIDIA susține că acesta este cel mai rapid rezultat înregistrat pentru modelul respectiv și că platforma oferă o „responsivitate” de 4 ori mai mare decât cea mai apropiată alternativă pentru agenți și alte sarcini cu latență critică. De ce contează: inferența devine „motorul” economic, iar viteza de generare e diferențiatorul NVIDIA își construiește argumentul în jurul faptului că sistemele „agentice” pot parcurge sute sau mii de pași de inferență și pot produce volume mari de tokenuri, ceea ce face ca viteza de generare să fie esențială pentru ca agenții să „raționeze”, să acționeze și să finalizeze sarcini complexe în timp real. În această logică, Groq 3 LPX este proiectat să crească interactivitatea platformei Vera Rubin NVL72 — adică ritmul în care sunt generate tokenurile pentru un utilizator individual, care determină cât de repede poate avansa agentul prin pașii unei sarcini. Într-o declarație inclusă în material, Jensen Huang, CEO-ul NVIDIA, leagă direct această direcție de cererea globală în creștere pentru capacitate de calcul AI și de rolul inferenței în extinderea utilizării modelelor lingvistice la scară. „Inferența este motorul de creștere al AI. (...) Vera Rubin (...) avansează frontiera performanței cu LPX pentru generare ultrarapidă de tokenuri.” Primii adoptatori: Nebius intră primul, Groq urmează Pe partea operațională, NVIDIA indică un prim val de adopție în zona de cloud AI. Nebius este prezentată drept prima companie de cloud AI care adoptă NVIDIA Groq 3 LPX și intenționează să îl aducă în Nebius Token Factory , platforma sa de inferență în producție, pentru a oferi dezvoltatorilor acces la viteze ridicate de generare a tokenurilor pentru aplicații „agentice”. Danila Shtan, CTO al Nebius, pune accent pe faptul că implementarea ar urma să fie disponibilă prin același API folosit deja de dezvoltatori, fără migrare la un „stack” (set de tehnologii) nou. „(...) facem ca fiecare pas din bucla unui agent să pară instant — prin același API pe care dezvoltatorii îl folosesc deja, fără migrare la un nou stack.” NVIDIA mai precizează că, după Nebius, furnizorul de cloud de inferență Groq plănuiește să fie printre cei mai timpurii adoptatori ai platformei. Context tehnic: cum se leagă Groq 3 LPX de platforma Vera Rubin Groq 3 LPX este descris ca un accelerator interactiv de inferență, construit pentru două provocări specifice „agentic AI”: procesarea eficientă a unor volume foarte mari de context; generarea de tokenuri cu latență extrem de redusă. În plus, NVIDIA plasează produsul în arhitectura mai largă a platformei Vera Rubin NVL72, menționând o abordare de „codesign” (proiectare integrată hardware-software) la nivel de rack și enumerând componente precum BlueField-4 DPU, rack-uri cu CPU Vera, stocare Vera BlueField-4 STX și rețelistică Spectrum-6 SPX Ethernet, cu obiectivul de a optimiza sisteme multi-agent pentru „throughput per watt” ridicat și inferență cu latență mică. [...]