Știri
Știri din categoria Inteligență artificială

Anthropic își apără prețul în fața rivalilor printr-un salt de productivitate la același cost: noul Claude Opus 4.7 ridică semnificativ performanța în codare și în sarcini „agentice” (fluxuri de lucru cu mai mulți pași și folosire de instrumente), fără scumpiri, potrivit The Next Web.
Modelul este poziționat ca „cel mai capabil” Claude disponibil pe scară largă și vine într-un moment în care miza comercială pentru Anthropic este ridicată: publicația notează că firma rulează la o rată anualizată de venituri de 30 de miliarde de dolari (aprox. 138 miliarde lei), ar fi primit oferte de investiții la o evaluare de circa 800 de miliarde de dolari (aprox. 3.680 miliarde lei) și ar fi în discuții incipiente pentru o listare (IPO). În acest context, Opus 4.7 trebuie să convingă companiile să construiască pe platforma Claude, nu doar să bifeze scoruri în teste.
Câștigul principal este în inginerie software, unde Opus 4.7 urcă pe SWE-bench Pro la 64,3% (de la 53,4% la Opus 4.6) și depășește GPT-5.4 (57,7%) și Gemini 3.1 Pro (54,2%). Pe SWE-bench Verified, scorul ajunge la 87,6% (față de 80,8% la predecesor), în timp ce Gemini 3.1 Pro este la 80,6%.
În paralel, CursorBench (un indicator pentru codare autonomă în editorul Cursor) arată 70%, de la 58% la Opus 4.6. The Next Web leagă această evoluție de utilizarea practică: Claude este deja o alegere implicită în Cursor și Claude Code, iar Claude Code ar fi atins în februarie o rată anualizată de venituri de 2,5 miliarde de dolari (aprox. 11,5 miliarde lei).
Diferențierea se mută însă dinspre „raționament pur” spre execuție în fluxuri complexe. Pe GPQA Diamond (raționament la nivel de studii avansate), scorurile sunt aproape egale: Opus 4.7 are 94,2%, GPT-5.4 Pro 94,4%, iar Gemini 3.1 Pro 94,3% — diferențe pe care publicația le descrie ca fiind în marja de variație.
Anthropic susține că Opus 4.7 aduce o îmbunătățire de 14% față de Opus 4.6 pe fluxuri de lucru complexe, multi-pas, folosind mai puțini „tokeni” (unități de text folosite la calculul costurilor) și generând o treime din erorile de instrumente. Compania mai spune că este primul model Claude care trece „teste de nevoie implicită”, adică situații în care modelul trebuie să deducă singur ce instrumente sau acțiuni sunt necesare.
O noutate importantă este coordonarea multi-agent: capacitatea de a orchestra mai multe „fire” de lucru AI în paralel, în loc de procesare strict secvențială. Pentru utilizări de tip enterprise (revizie de cod, analiză de documente, procesare de date în același timp), aceasta se traduce în debit mai mare de lucru. Anthropic afirmă și că modelul își poate menține „focusul” pe fluxuri de lucru de ordinul orelor, dar aceasta rămâne o afirmație de producător care depinde de validarea în utilizare reală.
Publicația mai notează accentul pe reziliență: Opus 4.7 ar continua execuția chiar și când apar eșecuri ale instrumentelor, în loc să se oprească — relevant pentru automatizări unde o singură eroare poate bloca un întreg lanț.
Pe partea de imagini, Opus 4.7 poate procesa rezoluții de până la 2.576 pixeli pe latura lungă, de peste trei ori față de modelele Claude anterioare. Ținta declarată este analiza de documente în companii (contracte scanate, desene tehnice, situații financiare), unde detaliile fine pot fi ratate la rezoluții mai mici.
Fereastra de context rămâne la un milion de tokeni (jumătate din cei două milioane ai Gemini 3.1 Pro), iar pe benchmark-uri de cercetare cu context lung, Opus 4.7 ar fi la egalitate pe primul loc la scorul total 0,715 pe șase module, cu o consistență ridicată.
Anthropic mai spune că modelul urmează instrucțiunile mai „literal” decât înainte, ceea ce poate cere ajustarea prompturilor existente: mai puțină ambiguitate și comportament „off-task”, dar și mai puține rezultate „creative” neașteptate.
Opus 4.7 este disponibil pe planurile Claude Pro, Max, Team și Enterprise și prin API la 5 dolari (aprox. 23 lei) per milion de tokeni de intrare și 25 de dolari (aprox. 115 lei) per milion de tokeni de ieșire — același nivel ca Opus 4.6. Există și mecanisme de reducere: „prompt caching” cu economii de până la 90% și Batch API cu discount de 50% la intrare și ieșire.
Modelul poate fi accesat și prin Amazon Bedrock, Google Cloud Vertex AI și Microsoft Foundry. The Next Web notează că Gemini 3.1 Pro este mai ieftin (2 dolari și 12 dolari per milion de tokeni pentru intrare/ieșire), însă avantajul Opus 4.7 pe SWE-bench și pe raționament „agentic” ar putea justifica prima de preț pentru companiile care au nevoie de capabilitate maximă.
În plus, Anthropic a adăugat măsuri automate de protecție cibernetică pentru a detecta și bloca solicitări interzise sau cu risc ridicat, pe fondul preocupărilor legate de utilizări cu dublu scop (civil și malițios). Publicația leagă această abordare de restricțiile anterioare aplicate modelului Mythos, disponibil doar pentru 11 organizații în cadrul Project Glasswing.
În esență, Opus 4.7 nu schimbă paradigma, dar mută raportul cost/performanță în favoarea Anthropic exact în zona care contează economic: codare și automatizare de fluxuri complexe, la același preț pe token.
Recomandate

Meta ar putea monetiza infrastructura AI printr-un acord de circa 10 miliarde de dolari cu Anthropic , într-un moment în care puterea de calcul și accesul la cipuri de ultimă generație au devenit un blocaj major pentru dezvoltatorii de modele, potrivit news.ro . Anthropic poartă discuții preliminare cu Meta Platforms pentru a închiria capacitate de calcul necesară antrenării și operării sistemelor sale de inteligență artificială, informație atribuită de news.ro postului CNBC. În paralel, The New York Times a relatat că este analizată o posibilă tranzacție evaluată la aproximativ 10 miliarde de dolari (aprox. 46 miliarde lei). După apariția informației, acțiunile Meta și-au redus pierderile în ședința bursieră de vineri. De ce contează: presiunea pe „puterea de calcul” și lipsa cipurilor Nvidia Negocierile vin pe fondul cererii în creștere pentru infrastructură dedicată inteligenței artificiale, în condițiile în care accesul la cipurile de ultimă generație produse de Nvidia rămâne limitat, una dintre principalele provocări pentru dezvoltatorii de modele AI. În acest context, Anthropic continuă să impună limite de utilizare pentru unele dintre cele mai avansate modele ale sale, pe fondul constrângerilor de infrastructură. Context: Anthropic a semnat recent un acord similar cu SpaceX Discuțiile cu Meta au loc la câteva săptămâni după ce Anthropic a anunțat un acord cu SpaceX, compania lui Elon Musk, pentru utilizarea capacității de calcul a centrului de date Colossus 1 , cu obiectivul de a îmbunătăți serviciile oferite abonaților plătitori. Miza pentru Meta: extinderea către servicii de tip cloud Pentru Meta, un astfel de acord ar fi în linie cu strategia de a valorifica investițiile masive în infrastructura AI și dincolo de propriile produse. Directorul general Mark Zuckerberg declara în luna mai că grupul analizează posibilitatea de a intra și pe piața serviciilor de cloud computing (servicii de închiriere a resurselor IT, precum servere și putere de calcul). Meta ar putea cheltui în 2026 până la 145 de miliarde de dolari (aprox. 667 miliarde lei) pentru investiții de capital, mare parte dintre acestea fiind destinate centrelor de date și infrastructurii AI, potrivit informațiilor citate de news.ro. Compania nu a comentat informațiile privind negocierile cu Anthropic. [...]

Google mizează pe modele Gemini mai ieftine și mai rapide pentru „agenți” AI, în timp ce versiunea de vârf Pro întârzie , potrivit TechCrunch . Google DeepMind a lansat marți trei modele noi — Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber — cu accent pe eficiență, latență și fiabilitate pentru clienții care rulează agenți AI la scară. Gemini 3.6 Flash este descris de Google drept „modelul de lucru” și promite îmbunătățiri la programare, activități de tip „knowledge work” și performanță multimodală, reducând în același timp consumul de „tokeni” (unități folosite la calculul costurilor și al volumului de text procesat) cu până la 17% față de 3.5 Flash — ceea ce ar trebui să îl facă mai ieftin în utilizare. Gemini 3.5 Flash-Lite este poziționat ca cel mai rentabil model din clasă, iar 3.5 Flash Cyber este o variantă specializată, ajustată pentru identificarea și remedierea vulnerabilităților de securitate cibernetică. Pentru acesta din urmă, Google spune că accesul va fi limitat inițial: modelul va fi disponibil exclusiv guvernelor și „partenerilor de încredere”, într-un program pilot cu acces restrâns. De ce contează: eficiență operațională acum, „Pro” mai târziu Lansarea e relevantă nu doar prin faptul că Google livrează modele mai ieftine și optimizate pentru producție, ci și prin absența unei actualizări pentru Gemini Pro, modelul de vârf al companiei pentru sarcini complexe de raționament și programare. Pro a fost actualizat ultima dată în februarie, iar între timp rivalii au accelerat ritmul: OpenAI a lansat GPT-5.5 și a început să extindă accesul la GPT-5.6, iar Anthropic a venit cu Claude Opus 4.8 și Claude Sonnet 5 și a extins accesul la modelul Fable 5, notează publicația. Google sugerase în mai că versiunea Pro „era deja folosită intern” și că urmează să fie lansată „luna viitoare”. Săptămâna trecută, Bloomberg a relatat că lansarea Gemini 3.5 Pro a fost întârziată din cauza dificultății de a atinge ținte interne de performanță. Ce urmează: testare cu parteneri și pregătiri pentru Gemini 4 Liderul de produs Google DeepMind, Logan Kilpatrick , a declarat marți că Google testează în prezent Gemini 3.5 Pro cu parteneri și speră să îl „lanseze în curând”. Tot el a spus că echipa a început „cea mai ambițioasă rundă de pre-antrenare de până acum” pentru Gemini 4 — un indiciu că Google încearcă să recupereze teren atât prin optimizări de cost și viteză, cât și printr-o nouă generație de modele. [...]

România riscă o polarizare a economiei pe fondul adopției „informale” a inteligenței artificiale , în condițiile în care utilizarea reală în companii pare mult peste statisticile oficiale, dar fără competențe digitale suficiente și fără sprijin sistematic pentru tranziție, potrivit unei analize citate de Economedia . Analiza „AI – impact pe piața muncii: index de poziționare la nivel european”, realizată de IMM România , plasează România în categoria „decalaj semnificativ” față de media UE-27 în pregătirea pieței muncii pentru inteligența artificială. Țara are un index final de 52,5 din 100 (unde 100 reprezintă media UE-27), sub toate statele din grupul regional de comparație: Cehia (92,1), Ungaria (77,1), Polonia (74,8) și Bulgaria (59,9), și mult sub Estonia (106,1), indicată ca reper de bune practici. Adopția crește, dar decalajul față de UE rămâne Între 2021 și 2025, adopția IA în firmele românești cu peste 10 angajați a crescut de peste trei ori, de la 1,4% la 5,2%. În același interval, media europeană a urcat de la 7,7% la aproape 20%, menținând un raport de aproximativ unu la patru. Concluzia analizei este că, fără intervenții țintite, România riscă să rămână permanent în urmă. În plus, IMM România susține că adopția reală depășește semnificativ datele oficiale: într-un sondaj propriu, 66,1% dintre firmele respondente declară că folosesc deja cel puțin un instrument de tip IA, față de 5,2% cât indică statistica oficială pentru companiile cu peste 10 angajați. Vulnerabilitatea majoră: competențe digitale și inovare slabă Analiza indică drept punct cel mai vulnerabil pilonul de inovare și adaptare instituțională, cu un scor de 20,5, asociat cu cel mai redus nivel al cheltuielilor de cercetare-dezvoltare din Uniunea Europeană. Pe zona de capital uman, doar 31,8% dintre români au competențe digitale cel puțin de bază, față de 60,4% media UE, ceea ce plasează România la cel mai redus nivel din Uniune. În acest context, IMM România avertizează asupra unei distribuții inegale a capacității de adaptare: un nucleu de firme și angajați avansează rapid, în timp ce microîntreprinderile și lucrătorii din sectoare tradiționale (comerț, transport, HoReCa, industrie) rămân expuși, fără mijloace de tranziție. Ce măsuri cere IMM România și legătura cu AI Act (2026–2027) Florin Jianu, președintele IMM România, spune că viteza de adopție „pe cont propriu” poate accentua polarizarea dacă nu este susținută prin politici publice și programe de formare. „Datele ne arată un paradox: antreprenorii români adoptă inteligența artificială mult mai repede decât o vede statistica oficială, dar o fac pe cont propriu, fără sprijin, fără ghiduri și fără competențele de bază extinse în forța de muncă. Miza următorilor doi ani nu este dacă IA va transforma piața muncii din România, pentru că o face deja, ci dacă vom lăsa această transformare să polarizeze economia sau o vom transforma într-o oportunitate pentru toate firmele, inclusiv pentru IMM-uri.” IMM România solicită, între altele: operaționalizarea unui Program național de alfabetizare IA pentru forța de muncă, sub forma unor vouchere de formare pentru IMM-uri și angajați; programe active de reconversie prin partenerii sociali, orientate către sectoare cu expunere ridicată și capacitate redusă de absorbție; pregătirea din timp pentru termenele de aplicare 2026–2027 ale AI Act (regulamentul UE privind inteligența artificială). Analiza este construită pe nouă indicatori oficiali Eurostat , grupați în patru piloni (capital uman digital, digitalizarea firmelor, structura ocupării și inovare) și este completată de un sondaj realizat în rândul a 463 de IMM-uri. [...]

Honor vrea să păstreze butonul fizic de AI pe seria Magic 9 , dar îl repoziționează pentru a reduce apăsările accidentale , potrivit Huawei Central . Informația indică o ajustare de design cu impact direct în utilizare: compania încearcă să facă butonul mai accesibil, după plângeri legate de poziționarea lui pe generația anterioară. Un „tipster” (persoană care publică neoficial informații despre produse) de pe Weibo, , susține că Honor va păstra un buton mic pe lateralul telefoanelor Magic 9 pentru acces rapid la anumite funcții, la fel ca pe modelele din seria Magic 8. Diferența ar fi poziția: nu ar mai fi neapărat sub butoanele de pornire și volum, ci ar putea fi mutat pe o altă latură a telefonului. De ce contează: butonul de AI a fost criticat pentru ergonomie Honor a introdus butonul fizic de AI anul trecut, odată cu seria Magic 8. Conform descrierii din material, apăsarea lungă pornește asistentul YOYO și duce utilizatorul direct către sarcini, iar dublu-tap poate deschide camera sau alte aplicații. Totuși, o parte dintre utilizatorii Magic 8 au reclamat că butonul este poziționat prost și poate fi apăsat accidental. În acest context, repoziționarea devine o schimbare operațională importantă: dacă butonul rămâne o componentă centrală a interacțiunii cu funcțiile de inteligență artificială, ergonomia lui poate influența direct cât de des este folosit (sau dezactivat/evitat). „Capcana”: poziția nouă nu este încă dezvăluită Sursa notează că tipsterul nu a indicat unde va fi mutat butonul, ci doar că Honor „optimizează” poziția pentru accesibilitate. Asta înseamnă că, deocamdată, schimbarea rămâne la nivel de informație neoficială și fără detalii de implementare. În paralel, materialul menționează că seria Magic 9 ar urma să includă și funcții din AgenticOS (un set de capabilități care ar crește „operabilitatea” butonului de AI), precum și upgrade-uri pentru agentul virtual YOYO în MagicOS 11. Detaliile despre ce anume va primi seria Magic 9 și cum va fi folosit butonul în aceste scenarii ar urma să devină mai clare pe măsură ce se apropie lansarea. [...]

Apple își întărește capacitățile de IA pentru China prin recrutarea echipei inițiale din spatele versiunii open-source a modelului Qwen , într-o mișcare care ar putea accelera adaptarea Siri la piața chineză și la constrângerile locale privind modelele și serviciile de inteligență artificială, potrivit Wccftech . Informația este atribuită analistului de IA Robert Scoble (fost Microsoft), iar publicația precizează că nu există o confirmare independentă. Totuși, în contextul în care Apple își adâncește parteneriatul cu Alibaba, recrutarea ar avea logică operațională: compania ar câștiga expertiză directă pe un model care urmează să fie pus la dispoziția utilizatorilor din China în cadrul „Apple Intelligence”. De ce contează: Siri în China depinde de parteneriate și execuție locală Apple a început să ofere utilizatorilor din China acces la familia de modele Qwen de la Alibaba prin interfața Apple Intelligence, într-un mod pe care Wccftech îl compară cu integrarea actuală a ChatGPT în ecosistemul Apple. Un purtător de cuvânt Alibaba a descris integrarea ca permițând accesul la capabilități precum „înțelegerea și generarea de text și imagini”, fără a comuta între instrumente. În acest cadru, aducerea „echipei originale” care a lucrat la versiunea open-source a Qwen ar putea reduce timpul de integrare și ajustare a funcțiilor Siri pentru limba, datele și cerințele pieței locale, unde Apple nu poate replica integral abordarea din SUA sau UE. Context: Apple își reconstruiește Siri și o împinge mai adânc în interfața iPhone Materialul notează că noua versiune Siri este integrată în Dynamic Island, are acces la „context personalizat” și poate folosi informații de pe ecran. Sunt oferite exemple de utilizare: întrebări despre un concert urmate de adăugarea datei în Reminders prin comandă vocală, identificarea conținutului unei imagini și furnizarea de context personalizat (de tipul unei persoane care locuiește lângă un parc), inclusiv indicații către o adresă. Ce urmează: Qwen3.8 și presiunea de a livra rapid În paralel, Alibaba pregătește lansarea modelului Qwen3.8 „destul de curând”, potrivit sursei. Wccftech sugerează că noua versiune ar ridica miza în competiția dintre modelele „open-source/open-weight” (modele cu greutăți publice, reutilizabile), ceea ce ar putea pune presiune pe Apple să țină pasul cu ritmul de actualizare al partenerului său din China. Separat, articolul amintește că Financial Times a relatat despre demersuri de lobby ale Apple pentru aprobarea achiziției de DRAM de la CXMT (aflată pe o listă a Pentagonului), iar Bloomberg, prin Mark Gurman, a scris că Apple ar lucra cu administrația Trump pentru a limita reacțiile negative din Washington dacă ajunge să cumpere memorie de la CXMT și YMTC pentru produse vândute în China. Aceste elemente conturează o strategie mai amplă: Apple încearcă să-și securizeze atât „motorul” hardware, cât și „creierul” software pentru operațiunile din China, într-un mediu geopolitic și de reglementare mai dificil. [...]

Un robot „centaur” cu roți și picioare promite să reducă riscul și costurile intervențiilor în medii periculoase , după ce compania chineză Runke JN (润科具能) a prezentat la Shanghai „prima” astfel de platformă la WAIC 2026 , potrivit IT之家 . Miza este una operațională: aceeași platformă ar putea acoperi inspecții autonome și intervenții de urgență în industrii unde accesul uman e scump, lent sau periculos. Robotul, descris ca „轮足复合” (o combinație între roți și membre), este poziționat pentru inspecții autonome, intervenții la incendii și operațiuni de salvare , cu personalizare pentru scenarii specifice. Conceptul urmărește să combine viteza deplasării pe roți cu capacitatea de trecere peste obstacole a unui robot cu picioare: pe teren plat se deplasează rapid, iar pe rampe, trepte, drumuri accidentate sau pe gheață și zăpadă ar trebui să își păstreze stabilitatea. Ce aduce diferit: mobilitate + manipulare de obiecte Potrivit companiei, partea superioară păstrează libertatea de mișcare a două brațe, astfel încât robotul poate „ca un om” să prindă, să răsucească și să opereze unelte. Partea inferioară folosește o configurație cu „patru roți-picioare”, pentru a trece de la rulare la depășirea obstacolelor. Extensibilitatea este prezentată ca un avantaj major: platforma ar putea integra „unificat” diverse configurații pentru partea superioară, inclusiv: brațe duble, „mâini” dextere, senzori de forță multidimensionali. Senzori și autonomie: de la percepție la decizie Robotul ar folosi un sistem „end-to-end” (cap-coadă) de percepție a mediului, dezvoltat intern, care combină lidar (scanare laser), vedere stereo și cameră de profunzime pentru a construi în timp real o înțelegere a mediului. În descrierea companiei, sistemul poate identifica conducte cu temperatură ridicată, vane și instrumente, obstacole și persoane, estimând poziția și starea acestora, apoi planificând traseul și ocolind obstacolele, într-un „ciclu închis” de la percepție la decizie. Capacitate de încărcare și scenarii vizate Pe partea de sarcină utilă, compania indică o încărcare medie de 100–120 kg și o încărcare statică maximă de 210 kg , peste platformele tradiționale cu patru picioare, conform aceleiași surse. În practică, asta ar permite transportul de unelte și echipamente și ar susține atât inspecția/monitorizarea, cât și intervenția după identificarea unei probleme, inclusiv prin teleoperare (control de la distanță). Scenariile menționate includ: oțelării (medii cu temperaturi ridicate), inspecții pe distanțe lungi în câmpuri petroliere, zone cu radiații în industria nucleară, intervenții ale pompierilor și operațiuni de urgență, minerit, teren accidentat și, la nivel de concept, inclusiv spațiul cosmic. Publicația notează că Shanghai Runke JN Technology a fost înființată în 2025, fiind deținută în comun de Runyang Technology și Fourier, cu sediul în Zhangjiang (Shanghai), și că dezvoltă soluții robotice pentru scenarii speciale. În material nu sunt oferite detalii despre preț, calendar de producție sau clienți contractați. [...]