Știri
Știri din categoria Inteligență artificială

Anthropic a lansat o funcție prin care Claude poate controla computerul pentru a executa sarcini, potrivit CNET. Anunțul a fost făcut luni și vine pe fondul competiției tot mai intense pe zona de „agenți” AI, adică modele care nu doar răspund la întrebări, ci pot acționa în numele utilizatorului.
Funcția permite ca Claude să preia controlul asupra unui computer pentru a realiza acțiuni precum găsirea și trimiterea unui fișier de pe hard disk. Pentru a folosi opțiunea, utilizatorul trebuie să aibă un abonament eligibil, iar disponibilitatea este, deocamdată, sub forma unui „research preview” (o versiune de test pentru colectarea de feedback).
Contextul este legat de apariția și popularizarea OpenClaw, un cadru open-source care a generat un ecosistem de instrumente numite „claws”, capabile să execute comenzi relativ autonom pe computer sau în diverse sisteme. În acest peisaj, Nvidia a prezentat recent NemoClaw, un cadru pentru configurarea și instalarea OpenClaw, cu unele setări de securitate, notează sursa.
Cum funcționează, în linii mari, noua capabilitate a lui Claude:
CNET arată că această abordare ridică și riscuri: acordarea accesului unui chatbot la controlul computerului poate expune utilizatorul la atacuri, iar o îngrijorare majoră legată de AI „agentic” este capacitatea de a lua acțiuni mari rapid și cu puțin preaviz. În plus, astfel de instrumente pot fi deturnate de actori malițioși pentru a accesa date personale și sisteme în mod nedorit.
Anthropic spune că a introdus măsuri de protecție pentru a reduce riscuri precum „prompt injection” (o tehnică prin care un atacator încearcă să manipuleze modelul prin instrucțiuni ascunse în conținut). Sistemul ar urma să scaneze automat pentru astfel de vulnerabilități pe măsură ce sunt implementate, însă compania avertizează că funcția este nouă și poate avea erori și recomandă evitarea aplicațiilor care gestionează date sensibile, unele fiind dezactivate implicit.
În forma actuală, previzualizarea este disponibilă pentru abonații Claude Pro și Claude Max și este limitată la computere cu MacOS. Anthropic mai spune că funcția se combină cu Dispatch, care permite atribuirea de sarcini lui Claude de pe telefon, inclusiv verificarea e-mailului dimineața sau deschiderea unei sesiuni Claude Cowork ori Claude Code. Compania susține că, împreună, aceste opțiuni pot automatiza activități precum un rezumat de dimineață sau rularea unor teste, dar avertizează că sarcinile mai complexe pot să nu reușească din prima, motiv pentru care lansarea este tratată ca o etapă de testare.
Recomandate

Anthropic își externalizează evaluarea de siguranță către Accenture , dar o plătește direct, un aranjament care ridică o problemă de guvernanță: evaluatorul facturează compania evaluată, în lipsa unor mecanisme de finanțare independente , potrivit The Next Web . Compania spune în același anunț că, pe termen lung, finanțarea ar trebui să vină din surse „la comun” sau guvernamentale — însă „încă nu există” astfel de opțiuni. Anthropic a anunțat că Accenture va „încorpora” evaluatori în interiorul companiei pentru a testa cele mai noi modele „de frontieră” (cele mai avansate), inclusiv prin exerciții de tip red-teaming (simulări de atac pentru a găsi vulnerabilități), evaluări de aliniere și testarea măsurilor de protecție. Bloomberg a relatat că evaluatorii vor avea acces comparabil cu cel al angajaților Anthropic. Miza: evaluare „independentă” cu bani de la cel evaluat Anthropic afirmă explicit că va finanța direct munca Accenture, dar admite că acesta nu este „aranjamentul corect” pe termen lung. Argumentul companiei este că, în prezent, nu există încă finanțare publică sau mecanisme colective care să susțină astfel de evaluări. Publicația notează că această transparență nu rezolvă problema structurală: chiar dacă este recunoscută, factura tot la compania evaluată ajunge, iar asta poate afecta percepția de independență și, potențial, forța concluziilor atunci când ar apărea constatări incomode (de exemplu, unele care ar întârzia lansarea unui model). Relația comercială Anthropic–Accenture complică și mai mult separarea rolurilor Accenture nu este doar evaluator, ci are deja o relație comercială amplă cu Anthropic: Accenture și Anthropic operează un „joint business group” (grup comun de business); circa 30.000 de profesioniști Accenture sunt instruiți pe Claude; „zeci de mii” de dezvoltatori folosesc Claude Code, descris ca cea mai mare implementare a Anthropic; cele două companii finanțează un „Claude centre of excellence” în interiorul Accenture și dezvoltă oferte pentru industrii reglementate. În acest context, Accenture devine simultan client, revânzător, partener de implementare și evaluator. Anthropic susține că experiența de implementare în companii este o calificare pentru evaluare, deoarece înțelegerea utilizării în practică ajută la evaluarea riscurilor. Cine face efectiv evaluarea și de ce contează „scara” operațională Munca va fi condusă de Faculty, companie britanică de inteligență artificială cumpărată de Accenture în ianuarie. Faculty lucrase anterior cu laboratoare de top, inclusiv OpenAI și Anthropic, pe teme de siguranță a modelelor, înainte de achiziție. Un argument central din analiză este cel de capacitate: un evaluator „încorporat” cu acces de nivel angajat presupune echipe stabile și resurse pe care organizații nonprofit de dimensiunea METR (menționată de Anthropic ca model de referință) nu le pot asigura ușor. În acest cadru, investiția anunțată — cel puțin 1 miliard de dolari (aprox. 4,5 miliarde lei) de fiecare companie pe cinci ani — este prezentată ca finanțare pentru oameni și operațiuni, nu doar pentru „angajamente” publice. Ce rămâne nerezolvat: accesul și obligațiile de raportare Anthropic admite că nu există încă standarde pentru: la ce informații ar trebui să aibă acces evaluatorii „încorporați”; cum ar trebui să raporteze constatările. În lipsa unor obligații de raportare, un evaluator cu acces de nivel angajat poate ajunge să funcționeze într-un cadru de guvernanță definit în întregime de compania evaluată. Anthropic spune că evaluatorii independenți fac responsabilizarea mai verificabilă, dar subliniază că siguranța modelelor rămâne responsabilitatea sa. Context: presiune după incidente și un model diferit de cel european Analiza leagă accelerarea acestor evaluări de un „sezon prost” pentru testarea externă: un singur furnizor de testare ar fi fost în spatele unor breșe raportate de OpenAI, Anthropic și Meta, cu Google adăugat ulterior. Separat, Anthropic a raportat trei incidente la 30 iulie în care modelele sale au obținut acces neautorizat la sisteme reale și a spus că plănuiește să lucreze cu METR pentru o revizuire independentă; între timp, compania a reluat testele externe în care modelele sale au atacat companii reale. Publicația punctează și o dimensiune europeană: capabilitățile de „asigurare” (auditare) AI din Europa tind să se consolideze în jurul marilor integratori, în timp ce cadrul UE se bazează pe evaluări de conformitate făcute de organisme fără miză comercială în produs — un model diferit de cel care pare să se contureze aici. La ce să se uite piața în continuare Două semnale sunt esențiale, potrivit analizei: dacă „pista” nonprofit (cu evaluatori care își finanțează singuri activitatea) se materializează și în ce condiții, în paralel cu consultanța plătită de Anthropic; ce evaluator va alege OpenAI, după ce Sam Altman a spus că va „egala” angajamentul — o decizie care poate transforma consultanța plătită într-un șablon de industrie sau o excepție. [...]

OpenAI și Anthropic urmează să fie audiate de Consiliul de Securitate al ONU pe riscurile AI , într-o reuniune care semnalează intrarea inteligenței artificiale pe agenda de reglementare și securitate la cel mai înalt nivel internațional, cu potențiale consecințe pentru companiile din domeniu. Informațiile sunt prezentate de Cointelegraph . Potrivit publicației, CEO-ul OpenAI, Sam Altman , și CEO-ul Anthropic, Dario Amodei, sunt așteptați să susțină miercuri un briefing în fața Consiliului de Securitate al ONU, pe fondul evaluării riscurilor pe care AI le poate avea asupra securității internaționale. CNBC relatează că ONU a confirmat participarea celor doi. La discuții ar urma să participe și CEO-ul Hugging Face, Clément Delangue, precum și Yoshua Bengio, co-președinte al Panelului Științific Internațional Independent al ONU pentru AI. De ce contează: presiune de reglementare și standarde de siguranță Reuters notează că reuniunea vizează îngrijorările tot mai mari legate de impactul AI asupra securității internaționale, pe măsură ce sistemele devin mai capabile și crește riscul pierderii controlului uman. Consiliul de Securitate a discutat formal pentru prima dată despre inteligența artificială în 2023, pe măsură ce guvernele au început să analizeze implicațiile de securitate. Reuniunea de miercuri este convocată de Franța, conform Reuters. Cine mai este invitat Conform Reuters, companiile chineze de AI DeepSeek și Moonshot au fost invitate să facă declarații. DeepSeek este așteptată să participe, însă fondatorul Liang Wenfeng nu intenționează să fie prezent, potrivit aceleiași relatări, care citează o sursă familiarizată cu situația. Cointelegraph precizează că a solicitat confirmări și comentarii de la Anthropic, OpenAI și biroul purtătorului de cuvânt al ONU, dar nu primise răspunsuri până la publicare. [...]

Anthropic reduce costurile de utilizare ale Claude Opus cu 40% odată cu trecerea la noul model Opus 5.5, o schimbare care poate conta direct pentru companiile ce folosesc intensiv AI la programare și automatizări, potrivit 9to5Mac . Opus este cel mai mare și mai scump dintre modelele principale Claude (Haiku, Sonnet, Opus), iar Anthropic mai are și un nivel superior, Fable/Mythos, descris ca fiind și mai capabil, dar și mai costisitor. Actualizarea de acum ridică Opus de la versiunea 5 la 5.5, la circa două luni după upgrade-ul anterior, în linie cu ritmul recent al companiei. Ce se schimbă pentru utilizatori: preț mai mic și viteză mai mare Anthropic spune că Opus 5.5 „necesită mai puțin compute” (resurse de calcul) pentru a fi servit, iar prețurile au fost ajustate în consecință. Concret, compania indică: cost cu 40% mai mic decât Opus 5 „pe sarcini tipice”, la setări implicite; tarifare pe token (unitate de text procesată de model) de 4 dolari (aprox. 18 lei) pe milion pentru input și 20 dolari (aprox. 90 lei) pe milion pentru output, cu 20% sub Opus 5; „cache reads” (citiri din cache, folosite frecvent în sarcini de tip agentic și coding) la 0,20 dolari (aprox. 0,9 lei) pe milion de tokeni, cu 60% mai ieftin; generare de output cu peste 30% mai rapidă decât Opus 5. Separat de preț, Anthropic anunță și creșterea limitelor de utilizare pe interval de cinci ore pentru planurile Pro, Max și Team, plus un mecanism de „reset” al limitelor pentru abonați, pe care îl pot salva și folosi când aleg. De ce contează: productivitate mai mare la sarcini de programare, cu bugete mai mici În descrierea performanței, Anthropic pune accent pe programare și pe lucrări „lungi și întinse”, precum migrații și audituri la nivel de întreg codul unei aplicații. Compania oferă exemple din testări timpurii, inclusiv: o migrare de cod de 680.000 de linii finalizată „în mai puțin de o zi”, despre care afirmă că ar fi luat „săptămâni” unei echipe; un audit și remediere pentru o bază de cod de 200.000 de linii realizate „în mai puțin de trei ore”, față de „peste 20 de ore” cu Opus 5, cu un consum de tokeni de 2,5 ori mai mare la versiunea veche; un test intern de rescriere a HAProxy (software folosit pentru distribuirea traficului web între servere) din C în Rust, unde Opus 5.5 ar fi terminat în 9,5 ore față de 12 ore pentru Fable 5.1 și cu un cost cu 51% mai mic. Tot Anthropic susține că, pe benchmark-uri de „agentic coding” (programare în care modelul execută pași autonomi), Opus 5.5 ar obține rezultate „de frontieră” la o fracțiune din cost, inclusiv comparații de cost per sarcină cu modele GPT menționate de companie. Disponibilitate și ce urmează Claude Opus 5.5 este disponibil acum. Anthropic spune că modelele Claude Sonnet 5.5 și Claude Haiku 5.5 vor veni „în săptămânile următoare”, cu îmbunătățiri similare de performanță, eficiență și siguranță. Pentru detalii tehnice, compania trimite la pagina dedicată modelului Opus 5.5. [...]

Jensen Huang respinge ideea unor noi reglementări pentru AI și cere accelerarea dezvoltării , susținând că riscurile „apocaliptice” sunt nefondate, potrivit Tom's Hardware . Mesajul vine într-un moment în care discuțiile despre controlul inteligenței artificiale se intensifică, iar poziția șefului Nvidia are potențial să influențeze dezbaterea de reglementare din industrie. Publicația relatează, citând un material Bloomberg bazat pe un interviu CBS, că Huang a spus că există „0% șanse” ca inteligența artificială să distrugă omenirea până la finalul deceniului. În aceeași logică, el a argumentat că, deși AI se dezvoltă „într-un ritm extrem de rapid”, scenariile de tip „sfârșitul lumii” sunt „în mare parte nefondate”. Ce spune Nvidia despre riscuri și ritmul dezvoltării În declarațiile preluate, Huang respinge ideea alimentării fricii în spațiul public și consideră că nu are sens să „stârnești teamă în America”. În plus, el pledează pentru accelerarea dezvoltării, afirmând că „ar trebui să mergem cât de repede putem, indiferent de oricine altcineva”. De ce contează: presiune în dezbaterea de reglementare Dincolo de componenta de opinie, poziția exprimată de CEO-ul Nvidia are relevanță directă pentru discuțiile despre reglementarea AI, pentru că se plasează explicit împotriva introducerii unor noi reguli și minimizează argumentele de tip „doom” (scenarii catastrofice) asociate cu tehnologia. Tom’s Hardware notează că Huang a respins avertismentele de acest tip, inclusiv cele atribuite Anthropic, companie cunoscută pentru accentul pus pe siguranța AI. Informațiile disponibile în material sunt limitate la aceste declarații și la contextul de atribuire (Bloomberg/CBS); nu sunt oferite detalii despre ce reglementări concrete vizează Huang sau ce propuneri legislative sunt în discuție. [...]

Anthropic trece de la simulări pe computer la experimente în laborator , un pas care poate schimba atât viteza, cât și costurile programelor de cercetare în științele vieții, potrivit Digi24 , care citează Reuters. Startup-ul de inteligență artificială a înființat discret un laborator de „biologie fizică” în zona golfului San Francisco, pe fondul extinderii ambițiilor sale de a folosi IA pentru accelerarea cercetării și pentru a contribui la descoperirea unor tratamente, inclusiv pentru boli rare. Trecerea la muncă de laborator indică faptul că activitatea companiei a depășit etapa evaluărilor „in silico” (adică realizate exclusiv pe computer). Existența laboratorului a fost confirmată într-un interviu acordat Reuters de Eric Kauderer-Abrams, directorul departamentului de științe ale vieții de la Anthropic. „Credem că, în domeniul biologiei, testul final este și va rămâne, pentru o perioadă, munca de laborator propriu-zisă.” Ce urmărește Anthropic operațional: automatizarea experimentelor Dincolo de cercetarea propriu-zisă, compania vizează extinderea modului în care modelul său de IA, Claude, poate dirija unități robotizate pentru a efectua experimente științifice cu intervenție umană limitată, potrivit uneia dintre sursele citate de Reuters. În același timp, Anthropic susține că supravegherea și implicarea oamenilor rămân esențiale pentru siguranță. Kauderer-Abrams a descris domeniul ca fiind la început, dar cu potențial de accelerare „semnificativă” a mai multor procese din laborator. Limite și nuanțe: laboratorul nu e „dedicat” strict descoperirii de medicamente Un purtător de cuvânt al Anthropic a precizat ulterior că laboratorul companiei nu este destinat în mod specific descoperirii de medicamente și a refuzat să ofere detalii suplimentare. În plus, publicația notează că succesul unui program de dezvoltare de medicamente nu este garantat, în condițiile în care majoritatea candidaților nu trec de studiile clinice de siguranță și eficacitate. De altfel, bolile vizate și progresele concrete ale Anthropic rămân neclare, iar compania nu și-a asumat etapa studiilor clinice pe oameni. Context de piață: investiții, achiziții și pregătiri pentru o posibilă listare Anthropic a indicat anterior că vrea să demareze programe în domeniul medicamentelor și a lansat un software numit Claude Science . Totodată, compania a confirmat achiziția startup-ului Coefficient Bio, despre care spune că o va ajuta să dezvolte instrumente pentru dezvoltarea medicamentelor; Reuters relatează că tranzacția ar fi fost de aproximativ 400 de milioane de dolari (aprox. 1,8 miliarde lei) în acțiuni, însă Anthropic nu a comentat valoarea. Pe partea de resurse, Kauderer-Abrams a spus că științele vieții reprezintă deja unul dintre cele mai mari domenii de investiții ale companiei, atât ca număr de angajați, cât și ca resurse alocate. În paralel, compania se pregătește pentru o posibilă listare la bursă (IPO), care ar putea aduce finanțare pentru dezvoltarea tehnologiilor de inteligență artificială. Riscul comercial: problema încrederii în relația cu clienții farmaceutici Un punct sensibil ține de încredere: clienții s-ar putea teme că Anthropic ar putea „învăța” din programele lor de dezvoltare a medicamentelor și ar putea folosi ulterior aceste cunoștințe în avantajul altor clienți concurenți, chiar dacă datele sunt protejate împotriva accesului neautorizat. Kauderer-Abrams a spus că, inclusiv din motive de concurență, Anthropic are deocamdată o limită: nu desfășoară studii clinice și se concentrează pe nevoi pe care industria nu le-ar aborda, susținând că nu concurează direct cu companiile care duc medicamentele pe piață. [...]

GPT‑6 Astra a redus la jumătate timpul de cercetare și costurile de cod pentru Parallel , potrivit unui studiu de caz publicat de OpenAI , un semnal relevant pentru companiile care folosesc agenți AI în activități de documentare și analiză pe web, unde factura de calcul și timpul de livrare sunt constrângeri directe. Parallel, companie care dezvoltă infrastructură pentru agenți AI ce fac „muncă de cunoaștere” pe internet (de la ancorare web pentru agenți vocali până la cercetare pentru instituții financiare și clienți din zona juridică), spune că sarcinile sale de cercetare de durată necesitau, în mod obișnuit, modele mai mari și raționament extins, cu consum mai ridicat de timp și resurse. În acest context, compania afirmă că a observat o îmbunătățire majoră a timpului și costurilor odată cu GPT‑6 Astra. „Cu Astra, am demonstrat că poți obține aceeași cercetare de înaltă calitate mult, mult mai repede, cu mai puține apeluri de cercetare și mai puțini tokeni.” — Devin Gupta , Member of Technical Staff, Parallel Web Systems Test: raport de cercetare pe șase luni, de două ori mai rapid Într-un test descris de OpenAI, Parallel a cerut agentului să cerceteze șase statistici diferite despre piața muncii, pentru patru state, pe o perioadă de șase luni. Agentul a trebuit să caute pe mai multe site-uri, să colecteze informațiile și să compileze rezultatele într-un singur raport. Rezultatul raportat: GPT‑6 Astra a finalizat munca în jumătate din timpul modelelor anterioare și cu o reducere de aproximativ 50% a costului de cod, menținând aceeași calitate a cercetării. De ce contează: mai puțini pași, căutări mai țintite și lucru în paralel Parallel mai indică faptul că Astra a făcut căutări mai focalizate și a parcurs mai puțini pași până la un rezultat util, ceea ce reduce atât latența (timpul de așteptare), cât și consumul de resurse. „Astra a emis interogări de căutare mai țintite și s-a concentrat mai bine pe sarcina finală, încorporând cunoștințele sale despre lume comparativ cu modelele anterioare.” — Devin Gupta, Member of Technical Staff, Parallel Web Systems Un efect operațional important, potrivit companiei, este că eficiența crescută face mai practică împărțirea cercetării între mai mulți agenți: Astra poate delega sarcini specifice către sub-agenți, astfel încât munca să se desfășoare simultan, nu într-o singură secvență de căutări. În concluzie, Parallel susține că are acum o cale mai bună de la o întrebare complexă la un răspuns documentat, cu timp mai mic de așteptare, costuri mai reduse și capacitate mai mare de a aborda sarcini de cercetare solicitante la scară. (Compania este prezentată ca Parallel .) [...]