211service.com
Come velocizzare i download di film
Ammettiamolo: i trasferimenti di file peer-to-peer su Internet sono lenti. Più della metà di tutti i download fallisce e il tempo medio di trasferimento per un file da 100 megabyte è superiore a 24 ore. Ma ora, un team di scienziati informatici guidati da Himabindu Pucha alla Purdue University, in Indiana, affermano di poter raddoppiare la velocità di questi trasferimenti sfruttando la sovrapposizione di blocchi di dati contenuti in file multimediali non identici pubblicati su reti di distribuzione peer-to-peer. Ciò migliorerebbe la probabilità di successo di questi trasferimenti.

Download veloci: Un nuovo approccio alla condivisione dei file può ridurre il tempo necessario per scaricare film e musica su reti peer-to-peer.
Reti di distribuzione peer-to-peer come BitTorrent e Kazaa consentire alle persone di scaricare singoli file dai computer di altri. Questi sistemi individuano prima le copie del file richiesto nella tabella di ricerca globale della rete utilizzando il suo hash, un identificatore univoco calcolato dalla sequenza di dati del file. Quindi, il file viene diviso in blocchi in modo che il computer di ciascun utente debba caricarne solo una piccola parte. Questa tecnica accelera i trasferimenti di file perché gli utenti domestici in genere hanno una maggiore larghezza di banda assegnata ai download rispetto ai caricamenti. Naturalmente, la velocità complessiva del trasferimento dipenderà dal numero di sorgenti di file e dalla capacità di caricamento di riserva di cui dispongono. Più un file è popolare, più veloce è il download e maggiori sono le possibilità di successo.
Informatico David Andersen , professore di informatica alla Carnegie Mellon University, ha lavorato con il gruppo Purdue per sviluppare un modo per aumentare le dimensioni del pool di uploader chiamato trasferimento potenziato dalla somiglianza (SET). L'approccio sfrutta più varianti degli stessi file musicali, clip video e software, che spesso fluttuano intorno alle reti di distribuzione dei file. Ci auguriamo che SET ti dia accesso a un pool più ampio di persone da cui scaricare, afferma Andersen. E così facendo, pensiamo che sia più probabile che tu trovi una di queste persone che ha più capacità di riserva.
Prima che Andersen e i suoi colleghi conducessero il loro studio, non era affatto chiaro quanta ridondanza esistesse nelle reti di condivisione di file e se potesse essere sfruttata, afferma l'informatico della Cornell University. Emin Gun Sirer , che non era coinvolto nello studio. Il team di SET ha analizzato quasi due terabyte di file musicali e video provenienti da reti di condivisione di file e ha scoperto che file simili erano generalmente condivisi tra il 20 e il 99 percento del loro contenuto. Con i file musicali, anche gli errori di ortografia nelle etichette di intestazione definite dall'utente che identificano l'artista e i titoli dei brani sono sufficienti per eliminare BitTorrent, nonostante il fatto che il 99 percento del file sia lo stesso. Allo stesso modo, sono spesso disponibili più versioni dello stesso video con tracce linguistiche diverse.
Una sfida nell'ideazione di un sistema di distribuzione in grado di individuare file simili è che il sistema deve cercare non solo ogni file ma anche ogni blocco all'interno di quel file. Un video clip da 700 megabyte può essere diviso in 40.000 blocchi, il che significa che il sistema deve eseguire diversi miliardi di confronti. SET è un sistema ibrido che individua prima gli utenti con file identici prima di cercare i blocchi richiesti nelle varianti di file. L'innovazione di SET in quest'ultimo compito è ciò che i ricercatori chiamano handprinting, che identifica in modo efficiente file simili utilizzando un numero costante di query di ricerca indipendentemente dalle dimensioni del file. SET divide il file richiesto in blocchi da 16 kilobyte, che vengono quindi distillati in hash da 160 bit o impronte digitali. Queste impronte digitali sono ordinate in base al loro valore numerico e il sistema seleziona le prime per formare l'impronta. Il confronto delle impronte delle mani, afferma Andersen, offre il 90% di possibilità di scoprire un file che è del 10% o più simile.
Individuare quel file con solo il 10% di somiglianza potrebbe accelerare i download dell'8%. Per i file musicali con una somiglianza superiore al 90%, un download di cinque minuti su BitTorrent richiederebbe poco più di due minuti con SET. Per un singolo utente, il risparmio potrebbe essere ancora maggiore se scarica una variante impopolare di un file comune. Andersen propone uno scenario in cui un utente con sede negli Stati Uniti scarica una versione tedesca di un film popolare. Attualmente, il film verrebbe molto probabilmente trasferito da una connessione all'estero più lenta. Ma con SEC, gli utenti possono sfruttare sorgenti locali più veloci per il video e ricevere solo l'audio dai colleghi tedeschi.
È uno schema molto intelligente per trovare i pezzi in comune, afferma Sirer. Tuttavia, afferma che per i contenuti più popolari, [SET] non farà troppa differenza perché ci sono già molti altri peer che ospitano quel contenuto. Ma posso immaginare che altri contenuti che altrimenti sarebbero lenti da ottenere da un singolo sciame potrebbero essere effettivamente più facili da scaricare.
Sebbene i ricercatori abbiano rilasciato il codice sorgente per il sistema SET, non hanno intenzione di creare un'interfaccia utente grafica per esso o di distribuirlo nelle attuali reti di condivisione di file. La matematica alla base era complessa da analizzare, afferma Andersen, ma l'idea è relativamente semplice e l'implementazione non sarà male. Dice che non sarebbe sorpreso se qualcuno implementasse il sistema SET nel prossimo anno.