211service.com
Deep Neural Network impara a giudicare i libri dalle loro copertine
L'idioma non giudica mai un libro dalla copertina mette in guardia dal valutare qualcosa semplicemente dal modo in cui appare. Eppure le copertine dei libri sono progettate per dare ai lettori un'idea del contenuto, per invogliarli a prendere un libro e leggerlo. Le buone copertine dei libri sono progettate per essere giudicate.
E gli umani sono abbastanza bravi a farlo. È relativamente semplice scegliere un libro di cucina o una biografia o una guida di viaggio solo guardando la copertina.
E questo solleva una domanda interessante: le macchine possono giudicare i libri anche dalle loro copertine? Sappiamo già che giudicano le persone dai loro volti.
Oggi riceviamo una risposta grazie al lavoro di Brian Kenji Iwana e Seiichi Uchida presso la Kyushu University in Giappone. Questi ragazzi hanno addestrato una rete neurale profonda per studiare le copertine dei libri e determinare la categoria di libri da cui provengono.
Maggiori informazioni sull'apprendimento automatico
Con il suo nuovo filtro fotografico, Facebook annuncia il suo piano per fare in modo che l'IA invada il tuo telefono
Lo strumento è divertente, ma è anche una missione per il gigante dei social network.
StarCraft diventerà il prossimo grande parco giochi per l'IA
L'intelligenza artificiale richiederà progressi chiave per poter giocare a un videogioco pieno di pianificazione, congetture e bluff.
Le macchine ora possono riconoscere qualcosa dopo averlo visto una volta
Gli algoritmi di solito hanno bisogno di migliaia di esempi per imparare qualcosa. I ricercatori di Google DeepMind hanno trovato un modo per aggirare il problema.
L'intelligenza artificiale di oggi non giustifica il reddito di base
Anche i lavori più semplici richiedono abilità, come la risoluzione creativa dei problemi, che i sistemi di intelligenza artificiale non sono ancora in grado di svolgere in modo competente.
Il problema della lingua dell'IA
Le macchine che capiscono veramente il linguaggio sarebbero incredibilmente utili. Ma non sappiamo come costruirli.
Il loro metodo è semplice. Iwana e Uchida hanno scaricato 137.788 copertine di libri uniche da Amazon.com insieme al genere del libro. Ci sono 20 generi possibili, ma dove un libro è stato elencato in più di una categoria, i ricercatori hanno utilizzato solo il primo.
Successivamente, la coppia ha utilizzato l'80% del set di dati per addestrare una rete neurale a riconoscere il genere osservando l'immagine di copertina. La loro rete neurale ha quattro strati, ciascuno con un massimo di 512 neuroni, che insieme imparano a riconoscere la correlazione tra design della copertina e genere. La coppia ha utilizzato un ulteriore 10 percento del set di dati per convalidare il modello e quindi ha testato la rete neurale sull'ultimo 10 percento per vedere quanto bene classifica le coperture che non aveva mai visto.
I risultati costituiscono una lettura interessante. L'algoritmo ha elencato il genere corretto nelle sue prime 3 scelte nel 40% delle volte e ha trovato il genere esatto più del 20% delle volte. Questo è significativamente meglio del caso. Ciò dimostra che la classificazione dei design delle copertine dei libri è possibile, sebbene sia un compito molto difficile, affermano Iwana e Uchida.
Alcune categorie risultano essere più facili da riconoscere rispetto ad altre. Ad esempio, i libri di viaggio e i libri su computer e tecnologia sono relativamente facili da individuare per la rete neurale perché i designer di libri utilizzano costantemente immagini e design simili per questi generi.
La rete neurale ha anche scoperto che i libri di cucina erano facili da riconoscere se utilizzavano immagini di cibo, ma erano del tutto ambigui se utilizzavano un design diverso come l'immagine dello chef.
Anche le biografie e le memorie erano problematiche con l'algoritmo che spesso selezionava la storia come categoria. È interessante notare che per molti di questi libri, la storia è il genere secondario elencato su Amazon, suggerendo che l'algoritmo non è stato del tutto confuso.
L'algoritmo ha anche confuso i libri per bambini con fumetti e graphic novel, nonché libri di medicina e libri di scienza. Forse anche questo è comprensibile date le somiglianze tra queste categorie.
C'è un difetto in questo lavoro. Iwana e Uchida non hanno confrontato le prestazioni della loro rete neurale con la capacità degli umani di riconoscere i generi di libri dalle loro copertine. Sarebbe un esperimento interessante e relativamente semplice da fare con un servizio di crowdsourcing online come Mechanical Turk di Amazon.
Fino a quando quel lavoro non sarà terminato, non c'è modo di sapere se le macchine sono migliori in questo compito degli umani. Anche se, non importa quanto siano bravi gli umani in questo compito, è sicuramente solo una questione di tempo prima che le macchine li superino.
Tuttavia, questo è un lavoro interessante che potrebbe aiutare i designer a migliorare le loro abilità quando si tratta di copertine di libri. Un risultato più probabile, tuttavia, è che potrebbe essere utilizzato per addestrare le macchine a progettare copertine di libri senza la necessità di input umani. E questo significa che il design delle copertine dei libri è solo un altro lavoro destinato a essere consegnato ai libri di storia.
Rif: arxiv.org/abs/1610.09204 : Giudicare un libro dalla copertina