Știri
Știri din categoria Inteligență artificială

Google are acces la de peste trei ori mai multe pagini web decât OpenAI, iar acest decalaj de date ar putea influența decisiv competiția din domeniul inteligenței artificiale, susține Matthew Prince, CEO-ul Cloudflare, într-un interviu recent pentru podcastul TBPN. Potrivit acestuia, datele interne colectate de Cloudflare în rețeaua sa arată că, pentru fiecare pagină accesată de OpenAI, Google parcurge 3,2, ceea ce îi oferă un avantaj major în antrenarea modelelor de AI.
Conform lui Prince, diferențele de acoperire nu se limitează la OpenAI. Google are acces la:
Această superioritate este explicată prin statutul privilegiat deținut de Google în ecosistemul online, câștigat de-a lungul anilor prin dominația în căutările web. Mulți administratori de site-uri permit Googlebot să acceseze zone protejate, inclusiv conținut aflat în spatele paywall-urilor, din dorința de a apărea în rezultatele căutărilor.
„Toată lumea i-a lăsat să treacă de paywall. Le-au permis accesul la părți ale internetului pe care nimeni altcineva nu le vede”, afirmă Prince, citat de Times of India.
Un alt element-cheie îl reprezintă rolul dual al Googlebot, care este folosit atât pentru indexarea căutărilor, cât și pentru colectarea de date în scopul antrenării modelelor AI. Asta îl face greu de blocat de către editorii web fără a-și compromite vizibilitatea în Google Search. Fişierele robots.txt, prin care website-urile limitează accesul crawlerelor, sunt adesea configurate special pentru a permite accesul Google, nu și altor crawlere AI.
Potrivit raportului Cloudflare Year in Review, publicat în decembrie 2025 și citat de Search Engine Journal, în lunile octombrie și noiembrie:
Prince susține că volumul de date la care are acces un model este chiar mai important decât resursele hardware sau resursa umană. În acest context, dominanța Google în web crawling poate deveni un obstacol serios pentru rivali. CEO-ul Cloudflare solicită intervenția autorităților de reglementare, fie pentru a limita utilizarea datelor web de către Google în scopuri AI, fie pentru a impune un acces egal la conținutul online pentru toți actorii din industrie.
„Cine are cele mai multe date, câștigă în era AI”, a declarat Prince, conform Intellectia.
Declarațiile vin în momentul în care Gemini, asistentul AI de la Google, câștigă cotă de piață în fața ChatGPT. Potrivit Similarweb, în ianuarie 2026:
Acest context amplifică preocupările privind monopolul datelor în AI și ridică întrebări despre cât de sustenabilă este competiția într-un ecosistem în care accesul la informație nu este echitabil.
Recomandate

Reddit ia în calcul să limiteze accesul Google la conținut pentru antrenarea AI , pe fondul scăderii traficului trimis din căutare, într-un semnal tot mai puternic că „troc-ul” clasic dintre platforme și motoarele de căutare se rupe, potrivit The Next Web . Miza este economică și operațională: Google a semnat în 2024 un acord care îi permite să își antreneze modelele pe postările de pe Reddit, evaluat la 60 milioane dolari pe an (aprox. 276 milioane lei), însă înțelegerea se apropie de final, iar Reddit nu ar fi convins că vrea să o reînnoiască „în vechii termeni”. După ce The Wall Street Journal a relatat despre discuțiile privind tăierea accesului Google, acțiunile Reddit au scăzut cu circa 9% într-o zi. De ce se schimbă negocierile: traficul, nu doar licența de date Problema centrală este că Google afișează tot mai des „ AI Overviews ” – rezumate generate de inteligență artificială în partea de sus a paginii de rezultate. Utilizatorii pot găsi răspunsul direct în rezumat și nu mai dau click către site-uri, ceea ce reduce vizitele pe care Reddit își monetizează publicitatea. În acest context, conducerea Reddit ar vrea ca un eventual nou acord să fie „taxat la utilizare”, nu pe o sumă fixă, conform articolului. Un purtător de cuvânt al companiei a spus pentru CNBC că Reddit negociază „ca orice afacere”, concentrându-se pe ce e mai bine pentru platformă, și că „multe s-au schimbat” de la primele acorduri, deși obiectivele au rămas aceleași. Nu e un caz izolat: și alți editori reevaluează relația cu Google Dincolo de Reddit, aceeași sursă arată că mai multe organizații media cântăresc cum – sau dacă – să continue colaborarea cu Google, între care USA Today, Reuters, Politico, The Economist și People Inc, potrivit The Wall Street Journal . Scăderea traficului de referință din Google este una dintre explicațiile principale invocate în piață: între iunie 2025 și iunie 2026, traficul de referință din Google a scăzut cu 23% la Politico și cu aproximativ 25% la CNN; la Business Insider, scăderea a depășit 85%. În plus, cercetări independente citate în articol sugerează că ratele de click pot scădea cu o treime până la jumătate atunci când apare un AI Overview. Reddit, prins între două roluri: furnizor de date și „victimă” a AI în căutare Reddit are o poziție aparte: conținutul său este foarte valoros pentru antrenarea modelelor lingvistice mari, iar directorul financiar Drew Vollero a numit platforma „cea mai citată sursă” pentru aceste modele, cu peste 25 de miliarde de postări. În același timp, Reddit licențiază date și către OpenAI, iar totalul acordurilor de conținut era de 203 milioane dolari (aprox. 934 milioane lei) la momentul listării din 2024. Compania crește puternic (venituri în T1 în urcare cu 69% față de anul anterior, conform articolului) și urmează să raporteze din nou pe 30 iulie, însă presiunea rămâne: aceleași răspunsuri AI care cresc valoarea datelor pot reduce traficul necesar pentru business-ul de publicitate. Replica Google și componenta de reglementare Google respinge ideea că ar „seca” web-ul de trafic: susține că trimite în continuare miliarde de clickuri zilnic și că AI Overviews ar distribui traficul către o gamă mai largă de site-uri. Liz Reid, șefa diviziei Search, a declarat pentru Tech Brew: „Căutarea nu este un produs util dacă web-ul nu este un produs prosper.” În paralel, există și o dimensiune de reglementare: Google oferă un instrument prin care editorii pot bloca antrenarea AI, dar folosirea lui poate afecta poziționarea în rezultatele obișnuite. Autoritatea de concurență din Marea Britanie a cerut ca editorii să poată opta pentru excludere fără această penalizare, iar Google testează regula acolo, potrivit articolului. În ansamblu, semnalul este că vechiul schimb „indexare contra trafic” se erodează, iar negocierile se mută spre tarife legate de utilizare, blocaje tehnice sau noi forme de licențiere – cu efect direct asupra veniturilor din publicitate ale platformelor și editorilor. [...]

OpenAI reduce puternic costurile pentru GPT‑5.6 Luna și Terra, schimbare care poate coborî semnificativ factura companiilor pentru aplicații AI la volum mare , potrivit OpenAI , care anunță și un nou „Fast mode” în API pentru GPT‑5.6 Sol, orientat spre viteză. Începând de astăzi, GPT‑5.6 Luna (modelul „cel mai rapid și cel mai accesibil” din familie) va costa cu 80% mai puțin, iar GPT‑5.6 Terra (model „echilibrat” pentru lucru de zi cu zi) cu 20% mai puțin. Reducerile se reflectă și în modul în care consumul este contabilizat în abonamentele plătite atunci când modelele sunt folosite prin Codex și ChatGPT Work, ceea ce înseamnă că aceeași utilizare „mănâncă” mai puține credite, fără schimbarea prețurilor abonamentelor sau a bugetelor de cotă. Ce se schimbă în prețurile API și de când OpenAI publică și noile tarife pentru API, cu aplicare de la 30 iulie: GPT‑5.6 Terra : 2 dolari (aprox. 9 lei) per milion de tokeni de intrare și 12 dolari (aprox. 55 lei) per milion de tokeni de ieșire GPT‑5.6 Luna : 0,20 dolari (aprox. 1 leu) per milion de tokeni de intrare și 1,20 dolari (aprox. 6 lei) per milion de tokeni de ieșire GPT‑5.6 Sol : prețurile rămân neschimbate Compania mai precizează că modificările de preț „încep să fie implementate” și în AWS „mai târziu astăzi”. De ce contează pentru companii: optimizarea cost–viteză pe același flux Unghiul economic al anunțului este legat de posibilitatea de a împărți un flux de lucru pe etape, folosind modele diferite în funcție de costul erorii, urgență și volum. OpenAI dă exemplul unui flux de programare în care Sol ar putea fi folosit pentru a reduce incertitudinea și a defini planul, iar Luna pentru implementare, scriere și rulare de teste și evaluarea rezultatelor, adică pentru pași „bine specificați” unde costul per execuție contează mai mult. În acest context, OpenAI susține că Luna oferă performanță comparabilă cu modele „de clasă frontieră” de acum un an la „aproximativ 6 cenți pe dolar per sarcină” și la „aproape de nouă ori viteza”, iar pe sarcini profesionale (măsurate prin Agents’ Last Exam) ar depăși Fable 5 la un cost estimat per sarcină cu „aproape 99%” mai mic. „Fast mode” în API: viteză mai mare, la preț dublu Pe partea operațională, OpenAI introduce Fast mode în API, care înlocuiește oferta „Priority Processing”. Pentru GPT‑5.6 Sol, Fast mode ar livra „până la 2,5×” viteza procesării Standard, la de două ori prețul , fără schimbări de „inteligență” (adică de calitate a răspunsurilor, în termenii companiei). Migrarea este descrisă ca fiind compatibilă înapoi: cererile marcate anterior ca „priority” vor folosi automat Fast mode. Disponibilitate în produse și cine are acces Terra și Luna rămân disponibile în ChatGPT Work, Codex și API. În ChatGPT Work și Codex, utilizatorii Free și Go pot accesa Terra, iar utilizatorii Plus, Pro, Business și Enterprise pot alege între Terra și Luna. Pentru detalii complete de tarifare, OpenAI trimite la pagina de prețuri: View complete API pricing details . [...]

Google extinde generarea de muzică cu IA în Flow Music prin lansarea Lyria 3.5 , un model care aduce utilizatorilor mai mult control asupra rezultatului (inclusiv tempo și durată) și promite îmbunătățiri la nivel de muzicalitate, versuri și voci, potrivit Google Blog . Actualizarea este disponibilă „de astăzi” în Google Flow Music , ceea ce mută accentul de pe simple demonstrații de tehnologie pe utilizare practică, direct într-un produs. Ce se schimbă, concret, în Flow Music Google spune că Lyria 3.5 aduce patru direcții principale de îmbunătățire: Muzicalitate îmbunătățită : modelul ar genera structuri melodice mai bogate și mai complexe, cu un sunet mai natural. Versuri mai bune : calitatea versurilor ar crește, cu o respectare mai bună a instrucțiunilor din prompt (cererea utilizatorului) și cu „conștientizare” mai bună a structurii. Voci îmbunătățite : vocile ar fi mai realiste și mai nuanțate emoțional, cu pronunție mai bună. Control creativ : utilizatorii pot controla mai ușor tempo-ul și durata rezultatelor generate. De ce contează pentru utilizatori și pentru produs Dincolo de promisiunea unei calități mai bune, elementul cu impact operațional este controlul mai fin asupra parametrilor (tempo și durată), care poate reduce numărul de iterații necesare până la un rezultat utilizabil. Google poziționează lansarea ca o extindere a capacității de a crea „piese mai bogate”, direct în Flow Music, unde utilizatorii pot testa modelul imediat. Google nu oferă, în materialul citat, detalii despre disponibilitate pe regiuni, prețuri sau condiții comerciale pentru accesul la Flow Music. [...]

Gemini pentru macOS primește dictare „inteligentă” și opțional acces la contextul de pe ecran , o schimbare care poate reduce timpul de redactare și editare direct în aplicațiile folosite zilnic, potrivit Google Blog . Noua funcție permite utilizatorilor să vorbească „natural” către Gemini prin apăsarea prelungită a tastei Fn, din orice fereastră de pe desktop. În modul implicit, aplicația face transcriere și „curățare” automată a textului dictat: elimină interjecții de tip „ăă”/„îî”, surprinde corecțiile făcute la mijlocul frazei și inserează textul formatat direct la cursor. Ce se schimbă operațional pentru utilizatori Pe lângă dictare, Google introduce o opțiune separată în setări, numită „ Gemini reasoning ”, care extinde funcționalitatea de la transcriere la executarea de sarcini mai complexe, pe baza contextului de pe ecran (adică înțelegerea a ceea ce este evidențiat sau vizibil în lucru). Exemplele oferite de companie includ: Extragere și rezumare de informații din fișiere locale, imagini sau documente evidențiate (de exemplu, rezumarea unor documente într-un e-mail). Compunere și rescriere de text oriunde pe ecran, cu ajustarea tonului și inserarea rezultatului în locul dorit (inclusiv formate de tip rezumat executiv cu „TL;DR”). Generare și editare de imagini prin comenzi vocale, inclusiv iterarea pe un design existent (de exemplu, o variantă „dark mode”). Disponibilitate și distribuție Funcția vocală nouă este în curs de lansare la nivel global pentru toți utilizatorii aplicației Gemini pentru macOS, în limba engleză , iar Google spune că vor urma și alte limbi. Aplicația poate fi descărcată de la https://gemini.google/mac/ . Google menționează și politica sa de confidențialitate, disponibilă la https://policies.google.com/privacy , fără a detalia în acest material condiții suplimentare legate de date pentru această funcție. [...]

Atingerea pragului de 1 miliard de utilizatori săptămânali pune presiune pe evaluarea OpenAI și pe „povestea” unui viitor IPO , dar faptul că ținta a fost ratată cu șapte luni arată că ritmul de creștere începe să se lovească de propriile limite, potrivit The Next Web . ChatGPT este „pe punctul” de a ajunge la 1 miliard de utilizatori activi săptămânal, pe baza unor cifre distribuite intern de OpenAI, informație relatată de The Information . Compania își propusese să atingă pragul până la finalul anului trecut, însă ar urma să îl bifeze abia la mijlocul lui 2026. De ce contează: utilizatorii susțin evaluarea și teza de monetizare Miza nu este doar una de imagine. Numărul de utilizatori este un argument central pentru evaluarea OpenAI în contextul unui posibil drum către listare (IPO), dar și pentru ideea că atenția consumatorilor — nu doar contractele cu companii — poate finanța costurile mari de calcul (compute) necesare rulării modelelor de inteligență artificială. În acest cadru, pragul de 1 miliard de utilizatori săptămânali funcționează ca un indicator de „tracțiune” la scară globală: publicația notează că aproximativ unul din opt oameni online ar folosi ChatGPT într-o săptămână, inclusiv pentru sarcini precum programare sau întrebări medicale. Întârzierea de șapte luni indică o frână în prognozele interne Deși performanța rămâne excepțională — ChatGPT ar fi ajuns la această scară în mai puțin de patru ani, fiind între cele mai rapide produse internet din istorie — întârzierea este prezentată ca un semnal mai relevant decât recordul în sine. La nivelul unui miliard de utilizatori, menținerea aceluiași ritm de creștere devine mult mai dificilă decât la 100 de milioane, iar ratarea țintei sugerează că inclusiv liderul pieței începe să își ajusteze așteptările. Evoluția utilizatorilor, așa cum este prezentată în articol: circa 400 de milioane de utilizatori activi săptămânal în februarie 2025; 800 de milioane în octombrie (menționat de Sam Altman); peste 900 de milioane în februarie 2026 (în linie cu o relatare anterioară a TechCrunch ); în iunie 2026, ChatGPT a devenit cea mai rapidă aplicație care a ajuns la 1 miliard de utilizatori activi lunar. Concurența erodează avantajul, chiar dacă OpenAI rămâne lider Articolul indică și presiunea competitivă: Gemini (Google) și un val de modele chineze mai ieftine „ciupesc” din utilizare la margini, iar rivalii nu mai sunt la fel de mult în urmă ca în urmă cu un an. OpenAI ar continua să conducă „la distanță”, dar accentul se mută de la extinderea avantajului la apărarea lui. În contrapunct, sceptici precum Gary Marcus (menționat într-un material anterior al publicației) susțin că așteptările pieței au depășit realitatea de business; pragul de 1 miliard de utilizatori săptămânali este, în această logică, un argument puternic pentru tabăra optimistă, chiar dacă a venit mai târziu decât promisese compania. [...]

Google încearcă să folosească DMCA ca barieră anti-scraping, dar instanța i-a respins cazul pe motiv de „lipsă de calitate procesuală” , iar miza se mută acum pe cât de departe pot merge platformele în a „închide” accesul la date publice de pe web, potrivit Ars Technica . Google a dat în judecată SerpApi în decembrie, invocând Digital Millennium Copyright Act (DMCA) – lege americană folosită frecvent pentru a combate ocolirea măsurilor tehnice de protecție a conținutului. Compania a susținut că SerpApi ar fi eludat tehnologiile anti-scraping ale Google, apoi ar fi vândut conținut extras din rezultatele de căutare printr-un „Google Search API” neautorizat. În argumentația Google, această ocolire ar fi pus în pericol relațiile cu deținători de drepturi, inclusiv cu cei care licențiază conținut ce apare în „ knowledge panels ” (casete informative afișate în unele rezultate). De ce contează decizia: DMCA nu poate fi folosit „prin ricoșeu” pentru rezultate de căutare Instanța a admis devreme cererea SerpApi de respingere a acțiunii (motion to dismiss), iar judecătorul a concluzionat că Google nu are calitate să dea în judecată în baza DMCA, deoarece nu deține conținutul din rezultatele de căutare și nu a arătat că acționează în numele unor deținători de drepturi. Meredith Rose, consilier de politici publice la organizația Public Knowledge, specializată în DMCA, a spus că argumentația Google și Reddit pare o încercare de a „apuca orice instrument disponibil” în fața creșterii accelerate a scraping-ului pentru inteligență artificială din ultimii trei ani. Ea a descris folosirea DMCA în acest context drept „bizară” și în afara scopului inițial al legii, dar nu surprinzătoare, având în vedere eficiența istorică a DMCA ca instrument rapid de blocare și de forțare a discuțiilor despre licențiere. Google nu renunță: 21 de zile pentru a rescrie plângerea Deși a pierdut această rundă, Google a primit 21 de zile pentru a-și modifica plângerea. Compania a recunoscut că rezultatele de căutare nu pot fi protejate prin drepturi de autor, dar a încercat să își ancoreze cazul în ideea că „knowledge panels” pot include conținut protejat, licențiat de la deținători de drepturi. Un purtător de cuvânt al Google, José Castañeda, a declarat că firma intenționează să depună o plângere modificată și că este „mulțumită” că instanța a respins „aproape toate” argumentele SerpApi care contestau calitatea procesuală a Google. Rose avertizează însă că această linie de apărare poate împinge Google într-un colț: dacă susține că acele casete sunt „pline” de material protejat, compania riscă să deschidă discuții despre conținut neacoperit de licențe și, implicit, despre posibile litigii viitoare legate de încălcarea drepturilor sau despre „utilizarea echitabilă” (fair use). Efect de contagiune: cazul Reddit și riscul de „re-îngrădire” a webului Reddit a mers pe o strategie similară, după ce a intentat în octombrie un proces apropiat ca logică, acuzând SerpApi și Perplexity că ar fi extras conținut Reddit care apare în rezultatele Google. Potrivit relatării, nu este clar cum va decide instanța în cazul Reddit, însă Rose consideră că hotărârea din dosarul Google nu este un semn bun pentru Reddit, deoarece acesta nu poate pretinde că este proprietarul sau licențiatul exclusiv al conținutului din rezultatele de căutare. SerpApi spune că lupta este costisitoare, dar o vede ca pe o apărare a „webului deschis” și acuză Google și Reddit că încearcă să folosească DMCA pentru a „zidi” Internetul prin revendicarea retroactivă a controlului asupra unui conținut pe care nu l-au creat și nu îl dețin. În plan operațional, SerpApi afirmă că procesele au creat incertitudine pentru clienți – compania menționează Nvidia, Uber și Adobe – care ar depinde zilnic de acces structurat la date de căutare. În plan mai larg, Rose leagă disputa de ceea ce numește „re-îngrădirea” webului, accelerată după vara lui 2023, când tot mai mulți actori au început să limiteze accesul automatizat, pe fondul creșterii scraping-ului pentru AI. Ea avertizează că efectele nu se opresc la antrenarea modelelor de inteligență artificială, ci pot afecta și cercetarea, arhivarea, jurnalismul sau raportările din sănătate publică, care se bazează pe crawling anonim și scraping la scară mare. Ce urmează: după expirarea termenului de 21 de zile, va deveni mai limpede dacă Google poate formula o plângere suficient de îngustă încât să supraviețuiască în instanță și dacă dosarul Reddit va fi respins pe o logică similară. [...]