211service.com
In che modo lo spam sta migliorando l'intelligenza artificiale
Quei fastidiosi enigmi visivi che devono essere completati ogni volta che ti registri per un account di posta Web o pubblichi un commento su un blog sono sotto attacco. Tuttavia, non è solo da computer o hacker che vomitano spam; proviene anche da ricercatori che utilizzano enigmi anti-spam per sviluppare algoritmi più intelligenti e più umani.

Gatti contro cani: Un progetto chiamato Asirra utilizza fotografie di cani e gatti per distinguere tra umani e computer. Normalmente, è un compito difficile per i computer, ma un nuovo algoritmo può classificare correttamente le immagini l'83 percento delle volte.
Il tipo più comune di puzzle (una serie di lettere e numeri distorti) viene sempre più risolto da software di intelligenza artificiale più intelligenti. E un informatico ha ora sviluppato un algoritmo in grado di sconfiggere anche gli ultimi test basati sulla fotografia.
Conosciuti come CAPTCHA (test di Turing pubblico completamente automatizzato per distinguere i computer e gli esseri umani), questi puzzle sono stati sviluppati alla fine degli anni '90 come un modo per separare gli utenti reali dalle macchine che creano account di posta elettronica per inviare spam o accedere al messaggio bacheche per pubblicare link ad annunci. Il Test di Turing , dal nome del matematico Alan Turing, consiste nel misurare l'intelligenza facendo in modo che un computer cerchi di impersonare una persona reale.
I CAPTCHA testuali sono un buon modo per distinguere gli umani dai bot spam, perché lettere e numeri distorti possono essere facilmente letti da persone reali (il più delle volte) ma sono diabolicamente difficili da decifrare per i computer. Tuttavia, gli scienziati informatici hanno da tempo visto i CAPTCHA come un'interessante sfida per l'intelligenza artificiale. I progettisti di CAPTCHA testuali hanno gradualmente introdotto una maggiore distorsione per impedire alle macchine di risolverli. Ma devono bilanciare la sicurezza con l'usabilità: man mano che la distorsione aumenta, anche i veri esseri umani iniziano a trovare i CAPTCHA difficili da decifrare.
All'inizio di quest'anno, Jeff Yan , un ricercatore dell'Università di Newcastle, nel Regno Unito, ha rivelato un programma in grado di completare i CAPTCHA testuali utilizzati per proteggere i servizi Hotmail, MSN e Windows Live di Microsoft con una percentuale di successo del 60%. Potrebbe non sembrare molto, ma è significativo, dal momento che un computer può provare il suo attacco migliaia di volte al minuto. Yan ha trattenuto il documento fino a quando Microsoft non ha avuto la possibilità di modificare i suoi CAPTCHA in modo che fossero più difficili da decifrare. Ma al Conferenza sulla sicurezza informatica e delle comunicazioni ACM ad Alexandria, in Virginia, alla fine di questo mese, Yan presenterà i dettagli di un altro programma che, secondo lui, può decifrare CAPTCHA testuali ancora più diffusi.
Quindi un'alternativa è chiedere agli utenti di risolvere diversi tipi di enigmi. Ma un altro documento che sarà presentato alla stessa conferenza descrive un algoritmo che potrebbe creare problemi anche per i CAPTCHA più recenti.
Philippe Golle del Palo Alto Research Center ha sviluppato un programma in grado di trasmettere correttamente un CAPTCHA basato su immagini chiamato Asirra, sviluppato da Microsoft. Asirra chiede agli utenti di classificare correttamente le immagini di cani o gatti utilizzando un database di tre milioni di immagini fornite dalle organizzazioni per il salvataggio degli animali. Questo compito dovrebbe essere ancora più difficile per i computer rispetto al riconoscimento delle lettere ondulate, ma il programma di Golle può identificare correttamente i gatti o i cani mostrati da Asirra l'83 percento delle volte.
Golle ha addestrato il suo programma utilizzando 8.000 immagini raccolte dallo stesso sito web. Attraverso tentativi ed errori, il suo software ha imparato gradualmente a distinguere cani e gatti, sulla base di un'analisi statistica del colore e della trama in ogni foto. Il rosa delle lingue dei cani e il verde degli occhi dei gatti hanno fornito indizi forti, dice Golle, ma è solo studiando le informazioni sul colore e sulla trama di così tante immagini che il suo programma potrebbe attaccare il problema. L'apprendimento automatico è molto bravo ad aggregare le informazioni, afferma Golle.
Tuttavia, sebbene ogni singola immagine sia stata riconosciuta l'83 percento delle volte, il test CAPTCHA completo richiede l'identificazione simultanea di 12 immagini, quindi l'attacco funziona effettivamente solo il 10,3 percento delle volte.
Golle afferma che una contromisura facile sarebbe che Asirra presentasse più immagini, il che ridurrebbe ulteriormente il tasso di successo dell'attacco. Microsoft non ha risposto alle nostre richieste di commento.
Nonostante tutti questi progressi, non è chiaro se i veri spammer stiano attualmente utilizzando attacchi AI contro veri CAPTCHA. Websense Security Labs, a San Diego, ha pubblicato rapporti sugli spammer che decidono di violare i CAPTCHA, ma spesso si tratta semplicemente di far risolvere manualmente i CAPTCHA a lavoratori sottopagati.
Luis von Ahn , un informatico della Carnegie Mellon University, che ha contribuito a coniare il termine CAPTCHA, afferma che non è chiaro se alcun CAPTCHA comune sia stato violato da un attacco automatico nel mondo reale. Non conosco nessuno che stia pensando di sbarazzarsi del CAPTCHA perché non funziona, dice.
Tuttavia, von Ahn osserva che l'uso di esseri umani ha un costo. Anche se i lavoratori vengono pagati solo $ 3 per 1.000 CAPTCHA, ciò è costoso, afferma, soprattutto perché la maggior parte degli account di posta Web compromessi verranno chiusi non appena iniziano a inviare spam. Quindi un attacco veramente automatizzato ridurrebbe i costi per gli spammer e aumenterebbe notevolmente il numero di attacchi di successo che potrebbero permettersi, dice.
Ma fino a quando i computer non inizieranno a diventare molto più intelligenti, i creatori di CAPTCHA saranno sempre in grado di implementare alcune semplici modifiche per rendere un CAPTCHA molto più difficile. Penso che ci sarà un giorno in cui, essenzialmente, i CAPTCHA saranno inutili, dice von Ahn. Ma non credo che sia quest'anno o il prossimo.