Correlato a questo argomentoConsiglio Tecnologia del Futuro e IA

Arriva il watermark di ChatGPT nell’UE, e OpenAI ha già pronto un rilevatore

  • OpenAI sta aggiungendo una filigrana invisibile ai testi di ChatGPT nell’UE.
  • Sostituendo il 25% delle parole con sinonimi, il rilevamento del plagio si è ridotto al 17%.
  • Solo i ricercatori approvati possono attualmente accedere al rilevatore di testo di OpenAI.
Promo

OpenAI sta aggiungendo una watermark invisibile di ChatGPT al testo generato dalla chatbot e all’output di codici di Codex in tutta l’Unione Europea. Tuttavia, i suoi stessi test dimostrano che sostituendo un quarto delle parole con dei sinonimi l’individuazione scende appena al 17%.

La decisione risponde all’AI Act dell’UE, il regolamento europeo sull’IA, che richiede etichette leggibili dalle macchine sui testi generati dall’IA. Tuttavia, OpenAI ammette che la tecnologia è ancora immatura, quindi il suo rilevatore per ora non è accessibile al pubblico.

Quanto è resistente la watermark di ChatGPT una volta che qualcuno modifica il testo?

Secondo l’annuncio, il sistema chiamato textGrain orienta le scelte delle parole del modello per lasciare una traccia statistica nascosta. Un rilevatore separato analizza i passaggi per trovare questa traccia.

La watermark è incorporata direttamente nel testo stesso, spiega OpenAI nella sua FAQ. Non vengono aggiunti né caratteri nascosti, né spazi invisibili, né punteggiatura insolita. Ciò significa che il classico trucchetto di eliminare i caratteri nascosti non ha alcun effetto.

Contenuto sponsorizzato
Contenuto sponsorizzato

La lunghezza è molto importante. OpenAI misura il testo in token, frammenti di parola elaborati dai modelli di IA. Un token corrisponde circa a tre quarti di una parola inglese.

Nei test di OpenAI, il rilevatore ha individuato circa il 66% delle risposte non modificate di circa 150 parole. Intorno alle 300 parole, la percentuale è salita a circa 92%.

Anche leggere modifiche indeboliscono la watermark di ChatGPT. Nei testi di 300 parole, sostituire una parola su 10 con un sinonimo ha ridotto l’individuazione dal 92% al 66%. Sostituendo una parola su quattro, si scende appena al 17%.

Il tasso di individuazione della watermark di ChatGPT diminuisce quando più parole vengono sostituite
Tasso di individuazione della watermark di ChatGPT dopo le modifiche. Fonte: OpenAI

La watermark ha influito appena sui punteggi benchmark di GPT-6 Astra di OpenAI, il modello di punta più recente dell’azienda.

Perché OpenAI non consente al pubblico di utilizzare il rilevatore?

Invece di uno strumento pubblico, OpenAI sta raccogliendo le candidature da ricercatori approvati e organizzazioni esperte. L’azienda afferma che un risultato positivo non rivela alcun utente, prompt o conversazione.

Anche un risultato negativo lascia molte incognite. Testi brevi, modificati o tradotti possono sfuggire al rilevatore, così come quelli prodotti da altri strumenti di IA concorrenti.

L’assenza della watermark rilevata non dimostra l’autorialità umana.

Fonte: OpenAI

Immagini e audio funzionano diversamente. Chiunque può caricare questi file sullo strumento pubblico di verifica di OpenAI e controllare la presenza della watermark SynthID.

Al di fuori dell’Europa, la watermark di ChatGPT è disattivata di default. Tuttavia, i clienti API a livello globale possono ora attivarla per alcuni modelli selezionati dalle impostazioni del loro progetto o organizzazione.

Il rilascio segue l’avvio ad agosto da parte dell’UE dell’enforcement della trasparenza prevista dall’AI Act. Per le crypto, la questione è concreta, dato che, secondo TRM Labs, l’adozione criminale dell’IA è cresciuta del 40% su base annua.

Pertanto, il divario tra ciò che le autorità di regolamentazione richiedono e ciò che i rilevatori riescono a provare probabilmente definirà come ogni importante laboratorio di IA gestirà la conformità.

Disclaimer

BeInCrypto si impegna a garantire un'informazione imparziale e trasparente. Questo articolo di notizie si propone di fornire informazioni accurate e tempestive. Tuttavia, si consiglia ai lettori di verificare i fatti in modo indipendente e di consultare un professionista prima di prendere qualsiasi decisione basata su questo contenuto. Si prega di notare che i nostri Termini e Condizioni, la nostra Informativa sulla Privacy e i nostri Disclaimer sono stati aggiornati.

Contenuto sponsorizzato
Contenuto sponsorizzato