Site icon JMD

Claude va introduce marcaje invizibile în textele generate de AI, în aplicarea noilor obligații de transparență din AI Act

Anthropic va integra în textele generate de Claude marcaje invizibile și detectabile automat, ca parte a măsurilor adoptate pentru respectarea obligațiilor de transparență prevăzute de Regulamentul european privind inteligența artificială (AI Act).

Potrivit informațiilor publicate de companie și relatate de presa europeană, marcajul va fi integrat direct în textul produs de modelele Claude, fără a fi vizibil utilizatorului și, potrivit Anthropic, fără a afecta sensul, calitatea sau lizibilitatea acestuia.

Spre deosebire de o simplă metadată atașată unui fișier, marcajul textual va face parte din outputul modelului. Din acest motiv, acesta va putea fi păstrat inclusiv atunci când textul este copiat și inserat într-un e-mail, într-un document Word sau pe o altă platformă și ar putea rămâne detectabil chiar și după anumite modificări ale textului.

Măsura este legată de art. 50 alin. (2) din AI Act, potrivit căruia furnizorii sistemelor de inteligență artificială care generează conținut sintetic — inclusiv text — trebuie să asigure că outputurile sunt marcate într-un format care poate fi citit automat și sunt detectabile ca fiind generate sau manipulate artificial.

Obligațiile de transparență prevăzute de art. 50 au devenit aplicabile în Uniunea Europeană la 2 august 2026.

Anthropic precizează că modelele Claude lansate începând cu această dată vor integra mecanismele de marcare de la momentul lansării, iar compania lucrează și la implementarea acestora pentru modelele anterioare, în perioada de tranziție.

Marcarea urmează să fie aplicată la nivelul modelului și nu doar în interfața Claude. Astfel, aceasta va putea fi prezentă și în conținutul produs prin Claude Platform (API), Claude Code, Claude Cowork și alte servicii care utilizează modelele compatibile, inclusiv prin infrastructurile unor furnizori terți.

Un document scris de om, dar corectat cu Claude, ar putea fi marcat
O consecință importantă privește utilizarea AI pentru redactarea și revizuirea documentelor profesionale.

Prezența unui asemenea marcaj nu va demonstra neapărat că întregul document a fost redactat de inteligența artificială. Claude poate fi utilizat, de exemplu, numai pentru corectarea ortografică, traducerea, reformularea sau revizuirea unui text redactat anterior de o persoană.

În asemenea situații, rezultatul procesat de model ar putea conține marcajul, deși conținutul inițial aparține utilizatorului. Publicația franceză Numerama oferă chiar exemplul unui e-mail redactat de o persoană și ulterior corectat cu Claude: detectarea marcajului ar indica intervenția AI, dar nu ar permite stabilirea întinderii acesteia.

Această distincție poate deveni relevantă inclusiv pentru avocați și alți profesioniști care utilizează instrumentele AI pentru revizuirea propriilor documente. Detectarea marcajului nu ar trebui, prin ea însăși, interpretată ca dovadă că documentul a fost redactat integral de Claude.
Anthropic avertizează și asupra situației inverse: absența unui marcaj detectabil nu demonstrează că textul a fost redactat exclusiv de o persoană. Modificările substanțiale, reformularea sau alte transformări pot afecta posibilitatea detectării.

Compania urmează să publice documentație tehnică suplimentară și instrumente care să permită utilizatorilor și terților să identifice marcajele introduse în conținutul generat de Claude.

Pentru fișierele compatibile, inclusiv anumite imagini PNG, JPG și SVG, Anthropic va utiliza și metadate de proveniență semnate digital, bazate pe standardul C2PA.

Sursa: Claude will apply invisible watermarks to AI text and images

Exit mobile version