Antropic ha annunciato l'introduzione di un watermark invisibile per i contenuti generati dai suoi modelli di intelligenza artificiale, una mossa che sembra promettere maggiore trasparenza. Questo watermark, basato su una funzione crittografica proposta da Scott Aronson, permette di identificare i testi generati dall'AI, ma solo a chi possiede la chiave giusta. Tuttavia, la tecnologia presenta limitazioni significative: la firma svanisce in scenari comuni come correzioni grammaticali o traduzioni, sollevando dubbi sulla sua efficacia reale.
Il watermark di Antropic è una risposta al codice di condotta sulla trasparenza dell'AI Act europeo, applicato globalmente per effetto del cosiddetto "Bruxelles Effect". Tuttavia, la mancanza di opzioni di disattivazione e l'assenza di trasparenza sui parametri di rilevamento sollevano preoccupazioni. La chiave segreta rimane nelle mani di Antropic, rendendo l'azienda arbitro unico dell'attribuzione dei contenuti, un potere che potrebbe avere implicazioni significative su scala globale.
Nonostante le promesse, il watermark si dimostra debole nei casi più critici, come i testi tecnici o le definizioni giuridiche, dove l'attribuzione è fondamentale. Inoltre, la soglia di rilevamento e il tasso di falsi positivi non sono stati chiariti, rendendo il sistema più un esercizio di compliance che una vera soluzione. In un contesto in cui la trasparenza è cruciale, la mancanza di chiarezza su questi aspetti potrebbe trasformare il watermark in un'arma a doppio taglio.
In questa Puntata
Scopri come una firma invisibile può cambiare il modo in cui percepiamo i contenuti generati dall'intelligenza artificiale. Ma è davvero una soluzione?