Il 7 ottobre 2026 Meta ha annunciato nuovi strumenti di intelligenza artificiale progettati per individuare le pubblicità che fanno da porta d’accesso a materiale di abusi sessuali sui minori. L’azienda ha inoltre riferito di aver rimosso 33.2 million contenuti di questo tipo da Facebook e Instagram nella prima metà dell’anno. Oltre il 97% delle rimozioni è avvenuto prima che gli utenti segnalassero i contenuti.
Come funzionano i nuovi strumenti
L’ultimo modello linguistico di grandi dimensioni di Meta, un’AI che elabora testi, cerca i cosiddetti «segnali di instradamento»: pubblicità che sembrano normali, ma portano gli utenti su siti illegali. Invece di limitarsi a controllare il testo dell’annuncio, il sistema segue il link per verificare dove conduce e può bloccare la destinazione se viola le regole. L’azienda ha inoltre aggiunto un «agente AI di red teaming», che cerca di aggirare i sistemi di sicurezza di Meta e aiuta gli ingegneri a correggerne i punti deboli prima che vengano sfruttati da malintenzionati. Ulteriori scansioni servono a individuare contenuti di sfruttamento che gli strumenti più datati non rilevavano; la piattaforma sta anche migliorando il riconoscimento dei recidivi che tornano con nuovi account.
Un impegno più ampio per la sicurezza dei minori
Le nuove misure basate sull’AI si aggiungono alle funzionalità per la sicurezza dei minori introdotte da Meta nel 2026, tra cui i controlli parentali per Meta AI, gli account WhatsApp per i preadolescenti e gli avvisi di Instagram quando gli adolescenti cercano contenuti sull’autolesionismo. Ad agosto, Meta ha accettato di pagare fino a $18 billion per chiudere una causa intentata da 29 stati degli Stati Uniti per questioni legate alla sicurezza dei minori.
Perché conta
Per gli utenti, l’AI potrebbe impedire che pubblicità dannose conducano di nascosto a materiale illegale, soprattutto i minori. I genitori potrebbero vedere meno link rischiosi nei feed, ma l’efficacia dei nuovi strumenti è ancora in fase di valutazione e l’azienda non ha pubblicato risultati di verifiche indipendenti.