Il web semantico diventa mainstream

Nel corso di una giornata, la persona media che lavora alla scrivania ha a che fare con torrenti di informazioni provenienti da molte fonti: e-mail, ricerche Web, calendari, note, fogli di calcolo, documenti e presentazioni. L'ordinamento delle informazioni è difficile e, per la maggior parte, viene eseguito in modo ad hoc. Ma nei prossimi due mesi potrebbe esserci un modo migliore. Reti radar , con sede a San Francisco, sta rilasciando uno strumento gratuito basato sul Web, chiamato Spago , che spera cambierà il modo in cui le persone organizzano le proprie informazioni.





Twine è un sito Web in cui le persone possono scaricare informazioni importanti per loro, dalle stringhe di e-mail ai video di YouTube. Oppure, se un utente preferisce, Twine può raccogliere automaticamente tutte le pagine Web che ha visitato, le e-mail che ha inviato e ricevuto, e così via. Una volta che Twine ha alcune informazioni, inizia ad analizzarle e le ordina automaticamente in categorie che includono le persone coinvolte, i concetti discussi e i luoghi, le organizzazioni e le aziende. In questo modo, quando un utente sta cercando qualcosa, può avere un rapido accesso alle relative informazioni. Twine utilizza anche elementi di social networking in modo che un utente abbia accesso alle informazioni raccolte da altri nella sua rete. Tutto questo crea una sorta di intelligenza collettiva, afferma Nova Spivack, CEO e fondatore di Radar Networks.

Spivack afferma che Twine sfrutta il lavoro di decenni svolto in campi di ricerca esoterici come l'apprendimento automatico e l'elaborazione del linguaggio naturale. Twine ti aiuta a diventare più intelligente, più produttivo e a collaborare, condividere e organizzare in modo più intelligente, afferma.

L'idea alla base della funzione e delle tecnologie di Twine è nota come Semantic Web, un concetto, a lungo discusso nei circoli di ricerca, che può essere descritto come una sorta di rete intelligente di informazioni in cui i dati sono taggati, ordinati e ricercabili. Spivack afferma che lo strumento della sua azienda è una delle prime applicazioni mainstream del Web semantico.



A dire il vero, Twine non è il primo prodotto o strumento del Web semantico. Per anni, le aziende hanno utilizzato software di database che inserisce automaticamente le informazioni in determinate categorie e le cerca di conseguenza, con vari gradi di accuratezza. Anche i semplici strumenti di blog di oggi hanno elementi del Web semantico: le persone aggiungono tag ai loro post, creando così metadati utili che possono essere cercati. Inoltre, delizioso , il sito di bookmarking online in cui le persone aggiungono tag ai collegamenti di pagine Web salvate, è un esempio di strutturazione di dati precedentemente non strutturati.

Pertanto, una definizione rigida e veloce del Web semantico può essere elusiva, afferma Argilla Shirky , professore nel programma di telecomunicazioni interattive presso la New York University. C'è una gamma in cui stai giocando, dice. Nella sua forma più elementare, afferma Shirky, il Web semantico è una campagna per taggare le informazioni con metadati extra che rendono più facile la ricerca. Al limite superiore, dice, si tratta di aspettare che le macchine diventino incredibilmente intelligenti.

Secondo Spivack, Twine può essere definita un'applicazione Web semantica perché il software è stato scritto con gli standard del Web semantico, stabiliti dal World Wide Web Consortium (W3C), in mente. Ciò significa che il suo design segue determinate convenzioni e, per questo motivo, Twine è compatibile con altre applicazioni Web semantiche e le sue informazioni possono essere condivise tra le applicazioni.



Oltre a utilizzare gli standard del Web semantico, Twine utilizza anche algoritmi di apprendimento automatico e di elaborazione del linguaggio naturale estremamente avanzati che gli conferiscono funzionalità oltre tutto ciò che si basa sulla codifica manuale. Lo strumento utilizza una combinazione di algoritmi in linguaggio naturale per estrarre automaticamente i concetti chiave da raccolte di testo, essenzialmente taggandoli automaticamente. Secondo Spivack, questi algoritmi gestiscono abilmente insiemi ambigui di parole, determinando, ad esempio, se J.P. Morgan è una persona o un'azienda, a seconda del contesto. E Twine può trovare l'oggetto di un testo anche se non viene mai menzionata una parola chiave, dice, utilizzando l'apprendimento automatico statistico per confrontare il testo con fonti di dati come Wikipedia. Possiamo determinare quando un documento riguarda un argomento anche se l'oggetto non è menzionato nel documento, dice Spivack. Quindi possiamo aggiungere nuovi percorsi e nuovi modi per arrivare al documento durante una ricerca.

Un'altra tecnica utilizzata da Twine è l'analisi dei grafi. Questa idea, spiega Spivack, è simile al pensiero alla base del social graph decantato da Mark Zuckerberg, il fondatore di Facebook: le connessioni tra le persone esistono nel mondo reale e gli strumenti di social network online raccolgono semplicemente quelle connessioni e le rendono visibili. Allo stesso modo, dice Spivack, Twine aiuta a rendere più accessibili le connessioni tra le persone e le loro informazioni. Quando i dati vengono taggati, diventano essenzialmente un nodo in una rete. Le connessioni che ogni nodo ha con altri nodi (che potrebbero essere altri dati, persone, luoghi, organizzazioni, progetti, eventi, eccetera) dipendono dai loro tag e dalla rilevanza statistica che hanno per i tag di altri nodi. Questo è il modo in cui Twine determina la pertinenza quando una persona cerca tra le sue informazioni. Più un nodo è lontano, meno è rilevante per la ricerca di un utente.

È ancora troppo presto per sapere se Twine avrà successo con i consumatori, afferma Tony Shaw, presidente di Semantic Universe, un'organizzazione impegnata ad aumentare la consapevolezza delle tecnologie semantiche negli ambienti aziendali e dei consumatori. Il successo non dipenderà semplicemente dal far funzionare la tecnologia, ma anche dalla gestione delle aspettative delle persone sulla tecnologia, afferma. Si tratta di combattere il problema dell'hype.



Twine si aprirà agli utenti invitati a partire da oggi. Nei prossimi due mesi, afferma Spivack, lo strumento accetterà più utenti ed entro l'estate del 2008 dovrebbe essere completamente aperto. Inoltre, Twine disporrà di una piattaforma aperta che consentirà agli sviluppatori di software di creare strumenti su di essa, come software di visualizzazione in modo che gli utenti possano vedere le proprie informazioni in modi diversi. Ma prima, iniziamo dalle basi, dice Spivack.

nascondere