Anthropic introduce un sistem prin care conținutul generat de modelele Claude va putea fi identificat prin marcaje invizibile pentru utilizator. Măsura vine în contextul noilor cerințe europene privind transparența conținutului generat de inteligența artificială.
Compania precizează că modelele Claude lansate în Uniunea Europeană începând cu 2 august 2026 vor include marcarea conținutului încă de la lansare. Textele generate vor primi filigrane („watermarks”) imperceptibile, iar anumite fișiere generate de Claude vor include metadate de proveniență semnate digital.
Un filigran pe care utilizatorul nu îl vede
Spre deosebire de o etichetă vizibilă de tipul „Generat de AI”, sistemul Anthropic este conceput să funcționeze la nivelul conținutului.
În cazul textului, Claude introduce un filigran imperceptibil direct în text. Anthropic spune că acesta nu modifică sensul, calitatea sau lizibilitatea răspunsului. Deoarece marcajul este integrat în text, el poate rămâne prezent atunci când conținutul este copiat și lipit în altă parte și poate supraviețui anumitor modificări.
Pentru fișierele compatibile, precum unele imagini și fișiere SVG, compania folosește metadate de proveniență semnate digital, bazate pe standardul C2PA — un standard deschis destinat urmăririi originii și istoricului conținutului digital.
Marcarea nu se limitează la Claude.ai
Sistemul este conceput să funcționeze la nivelul modelelor, astfel încât marcajele să fie aplicate indiferent de interfața prin care este utilizat Claude.
Anthropic spune că marcarea se aplică modelelor compatibile folosite prin Claude, API-ul Claude Platform, Claude Code, Claude Cowork și Claude Tag. Pentru modelele compatibile accesate prin servicii cloud precum AWS, Google Cloud sau Microsoft Foundry, filigranele pentru text vor fi aplicate atunci când sunt acceptate de platformă.
Compania afirmă, de asemenea, că sistemul se aplică la nivel global, nu doar în Uniunea Europeană.
De ce face Anthropic această schimbare
Decizia este legată de angajamentele asumate de Anthropic în cadrul Articolului 50 din AI Act al Uniunii Europene, care urmărește creșterea transparenței în privința conținutului generat sau manipulat cu ajutorul AI. Anthropic a semnat Codul de practică european privind transparența conținutului generat de inteligența artificială.
Compania spune că obiectivul este să ofere utilizatorilor și terților un semnal tehnic care să permită identificarea originii conținutului, pe măsură ce materialele generate de AI devin tot mai răspândite.
Un marcaj AI nu este însă o „dovadă absolută”
Anthropic subliniază că sistemul are limite importante.
Prezența unui marcaj indică faptul că un material poate să fi fost procesat de Claude, dar nu demonstrează neapărat că Anthropic sau Claude este autorul original al ideilor ori al informațiilor. De exemplu, un utilizator poate folosi Claude pentru corectură, traducere sau rezumare, iar rezultatul poate primi marcajul chiar dacă materialul inițial a fost creat de un om.
În același timp, absența unui marcaj detectabil nu înseamnă că un text nu a fost generat de AI. Filigranul poate deveni imposibil de detectat după editări ample, parafrazare, traducere sau combinarea textului cu alte materiale. În cazul fișierelor, metadatele pot fi eliminate prin conversie, resalvare sau chiar prin realizarea unei capturi de ecran.
Anthropic pregătește și instrumentele de detectare
Compania lucrează la mecanisme prin care utilizatorii și terții să poată verifica existența marcajelor. Detaliile tehnice privind detectarea urmează să fie publicate într-o documentație viitoare.
Un aspect important este că modelele lansate înainte de 2 august 2026 nu sunt automat acoperite de același sistem. Anthropic spune că lucrează pentru introducerea marcării și pentru modelele existente, în perioada de tranziție prevăzută de legislația europeană.
O nouă etapă în identificarea conținutului AI
Prin această schimbare, Anthropic trece de la simpla informare a utilizatorului la un mecanism tehnic de proveniență a conținutului. Ideea nu este ca oamenii să vadă un semn pe fiecare paragraf generat de Claude, ci ca materialul să poarte un indiciu care poate fi verificat de sisteme specializate.
Măsura ar putea deveni un model pentru industria AI, pe măsură ce regulile europene privind transparența intră în aplicare și furnizorii de modele sunt obligați să ofere modalități mai clare de identificare a conținutului generat artificial.
Sursa: Claude Help Center – How Claude marks AI-generated content
Sursa imagine- generata AI, Open AI
Ți-a fost util acest articol?
Abonează-te la newsletterul Lumea AI și primești săptămânal cele mai importante știri și ghiduri despre inteligența artificială.
Abonează-te gratuit pe Substack