Inteligență artificială14 aug. 2026
Instrumentele care promit să elimine watermark-ul invizibil din textele Claude se înmulțesc online - Fără detector public de la Anthropic, majoritatea nu pot demonstra că funcționează
Explozia de „removere” pentru watermark-uri AI creează un nou risc de supply chain , pentru că multe dintre aceste instrumente sunt integrate direct în fluxuri automate (agenți) și procesează documente, deși eficiența lor reală nu poate fi verificată în lipsa unui detector public, arată BleepingComputer . Piața a apărut la câteva zile după ce Anthropic a activat marcaje invizibile (watermark-uri) în tot ce scrie Claude. În paralel, au apărut proiecte pe GitHub, site-uri nou înregistrate și cel puțin un serviciu comercial de „evitare” a detecției, care promit eliminarea acestor marcaje. Ce se vinde, de fapt, ca „watermark remover” Printre cele mai vizibile proiecte este „watermarks-remover”, un instrument sub licență MIT al dezvoltatorului Guillaume Meyer (fondator Memo), care a pornit ca funcție pentru Claude și acum pretinde acoperire mai largă (inclusiv Gemini și alte scheme de marcare). În jurul lui au apărut și alte depozite, precum „claude-watermark-cleaner”, „remove-ai-watermarks” și „noai-watermark”, plus o serie de site-uri lansate recent (de tip claudewatermark.com, gptcleanup.com etc.). În zona comercială, BleepingComputer menționează StealthGPT (care vinde servicii de evitare a detecției) și Human Writes, care promovează inclusiv ocolirea unor sisteme precum Turnitin și GPTZero și afirmă că ar elimina watermark-ul Claude, deși include și un mesaj de conformare cu politicile de integritate academică. StealthGPT notează, totuși, pe propriile pagini că „niciun instrument nu garantează 100%” și că detectoarele se actualizează. De ce majoritatea promisiunilor nu pot fi verificate Problema centrală, potrivit publicației, este că nu există în acest moment o metodă publică de verificare : Anthropic nu a publicat încă detalii despre cum funcționează watermark-ul și nici nu a lansat un detector care să arate dacă un text „curățat” mai poartă marcajul. În plus, articolul separă trei tipuri de „curățare”, dintre care doar unele sunt verificabile: Eliminarea caracterelor ascunse din text (de exemplu caractere „zero-width”, controale bidirecționale, tag-uri Unicode, spații „lookalike”) – lucru măsurabil și verificabil. Ștergerea metadatelor (C2PA, EXIF, XMP) din fișiere (PNG, JPEG, SVG, PDF, DOCX, ODT, HTML, Markdown) – posibilă, dar cu impact limitat, deoarece metadatele se pierd oricum la re-salvare, conversie de format sau captură de ecran. Eliminarea watermark-ului propriu-zis – partea dificilă, pentru că marcajul nu „stă” în caractere ascunse, ci în alegerile de cuvinte făcute de model; singura metodă cunoscută ar fi rescrierea substanțială cu un alt model. BleepingComputer notează că Meyer a spus public că instrumentul său elimină, deocamdată, doar metadate, iar eliminarea marcajului efectiv „ar putea veni mai târziu”, dar nu este disponibilă acum. În schimb, unele site-uri comerciale promit ieșire „curată” și „nedetectabilă”, iar scorurile afișate ar fi raportate la detectoare obișnuite de conținut AI, nu la watermark-ul Anthropic (pentru care nu există detector public). Articolul citează și un test independent: Pasquale Pillitteri a clonat proiecte și a analizat codul, concluzionând că un „text cleaner” popular a lăsat neatinsă o tehnică frecventă de „payload” ascuns, care a putut fi decodată ulterior, deși instrumentul pretindea că a curățat textul. Contextul de reglementare: de ce a introdus Anthropic marcarea Anthropic a publicat o pagină de suport în care explică faptul că, pentru modelele lansate la sau după 2 august 2026, textul include un watermark imperceptibil „țesut” în formulare, iar anumite tipuri de fișiere primesc metadate C2PA semnate. Marcarea este aplicată la nivel de model și apare în API, claude.ai și alte produse, inclusiv prin integrări în AWS, Google Cloud și Microsoft Foundry. Declanșatorul este Articolul 50 din EU AI Act (reguli de transparență), aplicabil din 2 august, cu sancțiuni care pot ajunge la 15 milioane euro (aprox. 75 milioane lei) sau 3% din cifra de afaceri globală, conform materialului. Anthropic mai precizează că un watermark detectat indică faptul că un conținut a fost „procesat” de Claude, nu neapărat scris integral de acesta (de exemplu, corectură gramaticală, traducere, rezumat). Tot compania enumeră situații în care marcajul poate dispărea, inclusiv editare consistentă, parafrazare și traducere, și spune că va susține detecția de către terți și va publica documentație tehnică ulterior. Miza pentru companii: un nou vector de risc în lanțul de aprovizionare software Unghiul care ar trebui să intereseze direct organizațiile este cel operațional: instrumentele sunt conectate rapid în „agent pipelines” (fluxuri automatizate în care un agent software preia și procesează conținut), iar utilizatorii ajung să își treacă documentele prin cod neverificat. BleepingComputer avertizează explicit că nu a auditat și nu a testat niciunul dintre instrumentele menționate și recomandă prudență, ca în cazul oricărui cod nevalidat de pe internet. Publicația subliniază că, deși proiectele actuale sunt în mare parte deschise și pot fi citite, următorul val ar putea fi mai opac, într-o piață în care există cerere vizibilă (inclusiv un proiect cu peste 4.500 de „stele” pe GitHub) și, în același timp, nu există o modalitate publică de a verifica promisiunile . [...]