Anthropic ha introdotto una filigrana per i testi generati da Claude per soddisfare il requisito dell'EU AI Act, secondo cui i contenuti sintetici devono essere chiaramente contrassegnati in modo leggibile dalle macchine. L'azienda afferma che la tecnica segnala i testi scritti dall'IA senza rallentare il modello o utilizzare token extra, un'affermazione che regolatori e concorrenti metteranno presto alla prova.
Perché la filigrana è importante
La filigrana inserisce nelle decisioni di scelta delle parole una chiave privata e il contesto circostante. I lettori non possono vedere il pattern, ma un verificatore che conosca la chiave può individuarlo. In pratica, uno strumento a valle scansiona un documento e segnala se è stato prodotto da Claude.
Pressione normativa
L'EU AI Act impone ai fornitori di sistemi generativi di inserire segnali rilevabili nei contenuti sintetici.
Compromessi commerciali
Le aziende devono bilanciare tre preoccupazioni quando decidono se adottare tali marchi:
- Limiti di tracciabilità – La filigrana conferma che il testo proviene da un modello di IA, ma non può collegare l'output a un utente o a un account specifico. Questa lacuna lascia aperta la questione della responsabilità quando i contenuti generati dall'IA vengono utilizzati impropriamente.
- Rischio di ricavi – Alcuni fornitori temono che le filigrane visibili possano spaventare fino a un terzo della loro clientela, che preferisce testi non contrassegnati per ragioni di competitività o privacy.
- Vincoli tecnici – L'inserimento di un pattern può ridurre leggermente la creatività dell'output del modello, specialmente in frammenti molto brevi dove la filigrana ha meno parole a disposizione. Gli utenti possono anche diluire il segnale riformulando manualmente parti del testo, rendendo la rilevazione più difficile.
Anthropic scommette che il suo approccio eviti la maggior parte di questi svantaggi. Integrando la chiave nel processo di selezione dei token, l'azienda afferma che non vi è alcuna penalità in termini di latenza né costi extra di token, preservando l'esperienza utente che i clienti paganti si aspettano.
Sfide tecniche
La rilevabilità dipende dal fatto che il verificatore possieda la stessa chiave privata utilizzata durante la generazione. I testi brevi rimangono un punto debole perché il pattern statistico è meno pronunciato, aumentando i tassi di falsi negativi. La filigrana non impedisce inoltre le modifiche successive; un utente che riscrive metà del paragrafo può effettivamente cancellare il marchio.
Conclusione: La filigrana di Anthropic risponde a un nuovo mandato legale, ma il suo impatto dipenderà da quanto riuscirà a bilanciare la rilevabilità con la ridotta flessibilità e il rischio di essere aggirata.
