Watermarking-ul AI (marcajul digital pentru conținut generat) este o tehnică de inserare a unui semnal digital ascuns, invizibil sau greu de detectat pentru observatorul obișnuit, în conținutul generat de inteligență artificială — text, imagini, audio sau video — cu scopul de a permite identificarea ulterioară a faptului că respectivul conținut a fost creat sau modificat de AI, nu de un om.
Pentru imagini generate de AI, watermarking-ul poate lua forma unor modificări subtile la nivel de pixel, imperceptibile ochiului uman, dar detectabile printr-un algoritm specializat, sau a unor metadate digitale atașate fișierului care indică originea sa artificială. Pentru text generat de modele de limbaj, tehnicile experimentale de watermarking modifică ușor tiparul statistic al alegerii cuvintelor generate — favorizând subtil anumite cuvinte în locul altor sinonime echivalente — creând un „semnal” invizibil pentru cititor, dar detectabil statistic printr-o analiză specializată a textului.
Motivația principală pentru dezvoltarea acestor tehnologii este combaterea dezinformării și a utilizării frauduloase a conținutului generat de AI — deepfake-uri video folosite pentru manipulare politică, imagini false prezentate ca fotografii reale, sau texte generate automat folosite pentru a înșela sisteme de detectare a plagiatului academic.
Provocarea tehnică centrală rămâne robustețea: un watermark eficient trebuie să reziste la modificări comune ale conținutului (recomprimare, redimensionare pentru imagini; parafrazare pentru text) fără a fi eliminat accidental, dar, în același timp, ar trebui să fie suficient de rezistent încât să nu poată fi ușor eliminat intenționat de cineva care dorește să mascheze originea artificială a conținutului — un echilibru dificil de atins perfect, motiv pentru care watermarking-ul rămâne doar o componentă dintr-o strategie mai amplă de combatere a utilizării dăunătoare a AI generative, alături de reglementare și educație digitală.
