Chat GPT e compiti copiati: la novità che potrebbe presto mettere alle strette gli studenti
Attenzione se avete sempre utilizzato ChatGPT in modo indiscriminato per scrivere i vostri temi a scuola o le caption per i vostri social: la piattaforma di Intelligenza Artificiale di proprietà di OpenAI ha annunciato un cambio di rotta radicale che potrebbe rendervi la vita più difficile. Sarà infatti presto attivato un watermark digitale sui contenuti generati dal software, che renderà più facile identificare i testi che sono stati creati con un semplice click e che non sono stati rimaneggiati.
- Dalle app a ChatGPT, il manifesting sta assumendo nuove forme
- Quit ChatGPT: perché stanno tutti boicottando OpenAI? (anche Mark Ruffalo e Katy Perry)
- Ho sfidato ChatGPT per una settimana: vi racconto com'è andata
Il nuovo approccio di ChatGPT sulla provenienza dei testi
La novità è una scelta obbligata per OpenAI, che si è dovuta adattare al regolamento europeo EU AI Act, che impone ai fornitori di soluzioni IA generative di rendere i testi prodotti identificabili attraverso elaborazioni automatiche.
La nuova architettura di watermarking per il testo, denominata «textGrain», introduce un'impronta statistica impercettibile nelle sequenze di parole selezionate dal modello. Detto in altre parole: un po' come già accaduto con Claude, le formulazioni delle frasi, la presenza di strutture o parole particolari renderanno facilmente identificabili i testi creati con ChatGPT rimasti invariati.
In questo modo un detector speciale sarà in grado di analizzare la sequenza e dire: «Ehi, questo ritmo di parole appartiene a un modello OpenAI!». Va detto, però, che per evitare falsi allarmi lo strumento di rilevamento non sarà pubblico per tutti con un click, ma verrà fornito inizialmente solo a ricercatori ed enti specializzati.
Come funziona il watermark e perché premia il tocco umano
Nei test interni «textGrain» ha battuto altre tecnologie simili come «SynthID», ma nella vita reale le cose sono più sfumate. Un po' come i test di personalità sui social: divertenti e accurati, ma non sempre precisi! I detector possono prendere due abbagli:
- Falsi positivi: vedere l'IA dove invece c'è farina del sacco 100% umana;
- Falsi negativi: farsi sfuggire un testo generato dall'IA senza accorgersene.
I fattori che mettono in crisi il watermark sono due:
- La lunghezza e il genere del testo: se il testo è corto (sotto i 200 token) o riguarda temi rigidi come la matematica, dove non ci sono molti sinonimi tra cui scegliere, la filigrana è difficilissima da rilevare (e qui la precisione crolla). Se invece parliamo di argomenti più discorsivi come la psicologia e su testi lunghi (dai 400 token in su), il detector ci azzecca quasi sempre (fino al 95%);
- Il retouching e le modifiche: basta un po' di parafrasi per "annacquare" il segnale. Cambiando solo il 10% delle parole con dei sinonimi, la capacità di rilevamento scende dal 92% al 66%. Se si cambia il 25% del testo, la filigrana si dissolve e il detector lo individua solo nel 17% dei casi.
Insomma, più che un ostacolo, questa novità rappresenta una grande opportunità: prendere un testo creato dall'IA e copiarlo al cento per cento non è mai la scelta migliore. La presenza del watermark ci spinge a usare la nostra creatività, il nostro stile e le nostre skill linguistiche per rielaborare i contenuti. E il tocco personale, ovviamente, fa sempre la differenza.
Ciò che il watermark NON può dirti (le 5 regole d'oro)
Proprio come un segnale spuntato su una chat, il watermark dà un indizio, ma non racconta tutta la storia:
- Non misura la creatività umana: ti dice se l'IA ha generato una parte di testo, ma non quanta farina del tuo sacco, editing o intuizione ci hai messo tu;
- Non stabilisce la proprietà intellettuale: non decide di chi sono i diritti d'autore o se l'uso di quel testo sia legale;
- Non ti spia: il watermark è del tutto anonimo. Non risale alla persona, all'account, allo specifico «prompt» o alla chat privata;
- Non è un fact-checker: un testo con il watermark può comunque contenere inesattezze o fake news. La filigranatura attesta la fonte, non la verità. Fai sempre un controllo in più, non si sa mai!;
- Se non lo rileva, non significa al 100% che sia umano: il testo potrebbe essere stato tradotto, riassunto, modificato pesantemente, oppure generato da un altro modello concorrente.