211service.com
Ho perso una scommessa e ora lascerò che milioni di estranei controllino se siamo parenti
Qual è la possibilità che la polizia possa individuare la persona media utilizzando un database pubblico del DNA?
Di recente ho scommesso su quale sarebbe stata la risposta. Ora, grazie a due maghi della matematica in California, abbiamo una risposta.
E io sono il perdente, ma non di molto.
Tutto è iniziato dopo l'arresto del presunto Golden State Killer ad aprile. La polizia aveva caricato il DNA della scena del crimine su un sito web di genealogia ad accesso aperto, GEDmatch, e aveva localizzato alcuni dei suoi parenti. Infine, l'hanno trovato .
Il caso ha suscitato un enorme interesse tra genealogisti, giornalisti, genetisti e investigatori di ogni tipo. Come hanno fatto gli investigatori? La nostra privacy genetica è a rischio? Come mai questo non è mai successo prima?
Ma una domanda è emersa fondamentale (anche per chi è innocente di qualsiasi cosa): qual è la possibilità che potrebbero trovare voi?
Ho avuto un'ipotesi. Di recente abbiamo riferito della crescita esplosiva dei test genealogici del DNA, che più di 12 milioni di persone hanno ora eseguito. Immaginando che tutti abbiano dozzine di parenti, ho postato su Twitter che l'avrei fatto scommessa ogni americano ormai ha almeno un parente già in un database.
Quanto scommetti? licenziò Henry Greely, un professore di legge alla Stanford University.
Storia correlata
Storia correlata L'anno scorso più persone hanno eseguito test genetici rispetto a tutti gli anni precedenti messi insieme.Era acceso. In primo luogo, la definizione dei termini. In particolare, ero disposto a scommettere che più del 95% delle persone ne avrebbe trovato almeno uno cugino di secondo grado corrisponde in Ancestry.com, il più grande di questi database di ricerca relativa.
La scommessa avrebbe anche un avvertimento critico. Potrebbe applicarsi solo a persone di origine europea, perché è principalmente chi ha sostenuto i test.
E la posta in gioco? Il perdente dovrebbe presentare un campione di sputo, consentendo a milioni di estranei di confrontare i risultati del DNA con i propri.
Ora, grazie a un paio di accademici con un venerdì pomeriggio libero, abbiamo una risposta di sorta, e sembra che io sia il perdente.
La risposta viene dai genetisti matematici Graham Coop e Doc Edge. Il duo, con sede presso l'Università della California, a Davis, ha deciso di calcolare se la polizia è stata fortunata a trovare il sospettato o se i database ora sono così grandi da non potersi perdere.
In un post sul blog, evidenziano alcuni concetti chiave che hanno vincolato la risposta. Uno è l'esplosione genealogica. Questo è il loro termine per quanto immensamente aumenta il numero di possibili parenti quanto più distante permetti che la connessione sia. Hai solo uno o due fratelli. Ma puoi avere centinaia di cugini di terzo grado.
C'è un fenomeno opposto che restringe lo spazio di ricerca. Il motivo per cui è possibile abbinare i parenti è che parte del loro DNA è letteralmente lo stesso, o identico per discendenza. Ad esempio, condividi circa la metà del tuo DNA con tuo padre. Tu e un cugino di primo grado condividete del DNA dei due nonni che avete in comune.
Ma le relazioni più lontane hanno un DNA meno identico. Un cugino di terzo grado che probabilmente non hai mai incontrato? Meno dell'1 percento del tuo DNA è condiviso e talvolta nessuno. Quindi, per le relazioni più distanti, il DNA non può far corrispondere.
Edge e Coop hanno scoperto che la polizia della California aveva buone probabilità di trovare i parenti dell'assassino. Il database che hanno utilizzato, GEDmatch, contiene circa 950.000 profili. Secondo gli scienziati della UC Davis, le probabilità che un americano casuale di origine europea abbia un cugino di primo grado in GEDmatch è del 3,5%. È il 25 percento per un cugino di secondo grado e più del 90 percento per un cugino di terzo grado, di cui la polizia a quanto pare ne ha trovati diversi .
Come puoi immaginare, più grande è il database, maggiore è la possibilità che vi sia del DNA identico al tuo. In effetti, secondo le stime di Coop ed Edge, evitare una partita tra cugini di secondo grado è quasi impossibile su Ancestry.com, anche se non piuttosto tanto probabile quanto mi serviva per vincere la scommessa.
Secondo le loro stime, la possibilità di avere un cugino di secondo grado in quel database è del 94 percento, poco meno della mia ipotesi del 95 percento. Dal momento che Ancestry ha rifiutato di fornire la cifra esatta, andrò con quelli della banda dell'UC Davis e dirò che ho perso la mia scommessa per un naso.
Onestamente, non ho mai voluto che il mio DNA fosse testato. Aziende come 23andme e Helix mi hanno inviato kit gratuiti e non li ho mai rispediti indietro. Cosa imparerò? So più o meno da dove vengo. E non sono sicuro di voler localizzare qualche fratello non riconosciuto o sapere che il postino è davvero papà.
Inoltre, è ovvio che man mano che le dimensioni dei database crescono, diventeranno solo più potenti e nessuno può dire a quali usi potrebbero essere destinati in futuro. Una volta che rinunci al tuo DNA, come le tue impronte digitali, non puoi recuperarlo.
Il motivo per cui ho deciso di fare il test Ancestry, che costa $ 99, non è solo che sono un buon perdente. È che la scelta è già stata fatta per me. Secondo le stime di Coop, potrei avere altri 200 cugini di terzo grado e 1.000 cugini di quarto che sono già stati testati.
Il mio DNA, come il tuo, è già là fuori.