211service.com
Il motore di ricerca accademico coglie il significato
Se si può insegnare ai computer a trovare un significato nelle migliaia di articoli di ricerca pubblicati ogni anno, allora forse potrebbero automaticamente evidenziare nuove tendenze o scoperte importanti e trarne conclusioni.
Il Istituto Allen per l'Intelligenza Artificiale sta lavorando proprio per questo obiettivo e ha sviluppato un nuovo strumento chiamato Studioso semantico che può cercare tra milioni di articoli di informatica. Lo strumento, lanciato oggi, offre modalità per affinare le ricerche in base alle informazioni estratte dal testo degli articoli.
È, ad esempio, possibile restringere la ricerca in base alla rivista in cui è stato pubblicato un articolo, alla conferenza in cui è stato presentato, o al set di dati utilizzato. Lo studioso semantico mostrerà anche le frasi chiave in un documento.
Esistono già molti motori di ricerca accademici, tra questi Google Scholar , Ricerca accademica Microsoft , PubMed , e JSTOR . Ma questi in genere cercano solo tra i documenti utilizzando parole chiave e altre informazioni chiaramente classificate, come la data di pubblicazione.
Oren Etzioni , direttore esecutivo dell'Allen Institute, afferma che molte informazioni pertinenti trovate nei documenti di ricerca sono presentate in modi diversi. Il software alla base di Semantic Scholar è stato addestrato per estrarre concetti diversi utilizzando una varietà di tecniche di apprendimento automatico. Con milioni di giornali che escono ogni anno, non riesci proprio a stare al passo con loro, dice Etzioni. Quindi hai bisogno di un certo livello di comprensione.
C'è un crescente interesse nell'uso dell'apprendimento automatico per addestrare i computer a riconoscere determinati concetti nei dati. Google sta costruendo un cosiddetto grafico della conoscenza dei concetti addestrando algoritmi per eseguire la scansione del Web ed estrarre informazioni utili. Questo è il motivo per cui, quando cerchi Quanti anni ha Barack Obama, Google non solo pubblicherà pagine Web che potrebbero contenere le informazioni, ma ti dirà anche direttamente che ha 54 anni.
Altre aziende stanno cercando di fare qualcosa di simile con i documenti accademici. Una società ha chiamato Meta ha inoltre annunciato oggi un servizio che identificherà automaticamente le persone e le entità menzionate nella letteratura medica. Meta utilizza la tecnologia sviluppata da SRI, attraverso un progetto chiamato FUSE, per prevedere le tendenze scientifiche utilizzando l'apprendimento automatico.
Il CEO di Meta, Sam Molyneux, afferma che il servizio, che sarà attivo entro la fine di questa settimana, può consigliare documenti a un utente in base ai concetti all'interno di un documento che ha letto in precedenza e può persino identificare automaticamente le tecnologie emergenti. In sostanza, ti consente di tracciare a livello di concetto, o livello di tecnologia, piuttosto che a livello di articolo, afferma Molyneux. Concetti come la tecnologia CRISPR, che sta davvero rivoluzionando il modo in cui l'ingegneria del genoma sta avvenendo in questo momento, l'abbiamo presa come concetto emergente diversi anni fa.
Etzioni afferma che l'obiettivo di Semantic Scholar è di andare oltre fornendo ai computer una comprensione molto più profonda delle nuove pubblicazioni scientifiche. Il suo team sta sviluppando algoritmi che leggeranno grafici o grafici nei documenti e tenteranno di estrarre i valori ivi presentati. Alla fine vogliamo essere in grado di prendere un documento sperimentale e dire: 'Ok, devo leggere questo documento o il computer può dirmi che questo documento ha dimostrato che questo particolare farmaco è altamente efficace?'