
OpenAI ha annunciato che incorporerà una filigrana invisibile e leggibile dalle macchine, denominata textGrain, nel testo generato da ChatGPT e Codex per gli utenti dell'Unione Europea. La funzione, che verrà rilasciata questa settimana, è presentata come una risposta diretta all'AI Act dell'Unione Europea, che obbliga i sistemi di IA ad alto rischio a fornire meccanismi di tracciabilità per combattere la disinformazione e i deepfake.
La filigrana non è visibile agli utenti finali; invece, codifica un sottile schema di probabilità dei token che può essere rilevato da strumenti specializzati. OpenAI afferma che il suo approccio ha "eguagliato o superato" le prestazioni di soluzioni concorrenti come SynthID di Google DeepMind e il recente sforzo di filigranatura di Anthropic. Incorporando dati di provenienza nella fase di generazione, OpenAI spera di fornire a regolatori e piattaforme a valle un modo affidabile per segnalare i contenuti generati dall'IA.
Dal punto di vista della sicurezza, questa mossa è a doppio taglio. Da un lato, offre una leva tecnica per rilevare il testo sintetico, il che potrebbe aiutare le piattaforme a contrastare la diffusione di disinformazione, phishing o frodi che sfruttano i grandi modelli linguistici. Dall'altro, l'opacità della filigrana solleva preoccupazioni su falsi positivi e la possibilità che gli avversari possano ingegnerizzare al contrario o rimuovere il segnale, compromettendone l'efficacia. Inoltre, la dipendenza da un metodo di rilevamento proprietario ripone molta fiducia nell'implementazione di OpenAI, una fiducia che potrebbe non essere facilmente auditata da ricercatori indipendenti.
Gli esperti di politica considerano il lancio come una prova decisiva per la praticità e l'applicabilità dell'AI Act. La legislazione richiede che i sistemi di IA "ad alto rischio" siano "trasparenti e tracciabili", ma non prescrive standard tecnici specifici. La filigrana di OpenAI stabilisce quindi un precedente nel settore, ma evidenzia anche la mancanza di un quadro unificato per la provenienza tra i fornitori. Se i regolatori accettassero la soluzione di OpenAI, potrebbe esercitare pressione sui concorrenti per adottare misure simili, portando potenzialmente a un ecosistema frammentato di schemi di filigranatura incompatibili.
I critici sostengono che il focus dell'UE sulla filigranatura potrebbe distogliere l'attenzione da sfide di governance più ampie, come la privacy dei dati, la licenza dei modelli e la responsabilità per gli output dannosi. Avvertono che una soluzione tecnica da sola non può affrontare i rischi sistemici posti da modelli linguistici sempre più capaci.
Per gli sviluppatori e le aziende che integrano ChatGPT tramite API, la nuova filigrana sarà attiva per impostazione predefinita per le richieste provenienti dall'UE, sebbene OpenAI affermi di fornire un'opzione di opt-out per le implementazioni non UE. L'azienda si è anche impegnata a rilasciare una libreria di rilevamento open source, un passo che potrebbe migliorare la trasparenza ma potrebbe anche accelerare una corsa agli armamenti tra creatori e rimovitori di filigrane.
In sintesi, la filigranatura del testo di OpenAI segna uno sforzo concreto di conformità sotto l'AI Act, ma solleva anche domande durature sull'equilibrio tra obblighi normativi, fattibilità tecnica e preservazione della fiducia degli utenti nei sistemi di IA.
Foto: Luca Bravo / Unsplash (https://unsplash.com/@lucabravo)
AI-powered attacks are reshaping cyber defense, forcing organizations to adapt strategies and regulators to consider new safeguards.

As offensive cyber operations increasingly leverage advanced capabilities, the need for red teaming to simulate post-breach scenarios for AI agents has become critical. This proactive approach is essential for ensuring the resilience and trustworthiness of autonomous systems in a complex threat landscape.

As 2027 approaches, organizations face a critical juncture in AI adoption, demanding robust governance, stringent security, and clear value realization to navigate an impending era of heightened accountability and regulatory scrutiny.

New Linux implants disguise themselves as Asian email security products, highlighting the need for AI‑enhanced defenses.

Commenti