Di Ross E Curtis, Esperti scienziati presso AncestryDNA
Le tue corrispondenze di DNA sono uno strumento prezioso per esplorare la tua storia familiare. Puoi usare le corrispondenze e i relativi alberi per colmare le lacune nella ricerca genealogica e scoprire antenati condivisi. Inoltre, le corrispondenze non sono solo legate a te, ma sono spesso correlate tra loro.
Nei casi in cui non sai come tu e una corrispondenza siete correlati, sapere come le corrispondenze sono correlate tra loro può aiutarti a fare nuove scoperte. Funzionalità come Corrispondenze condivise e Corrispondenze condivise avanzate possono aiutarti con questo processo. Tuttavia, l’utilizzo di queste funzionalità può richiedere molto impegno e abilità per capire come tutte le tue corrispondenze sono collegate.
Ecco perché gli scienziati di Ancestry hanno sviluppato Corrispondenze per cluster, una nuova potente funzionalità per i membri di Ancestry Pro Tools*, che utilizza la nostra eccezionale tecnologia di corrispondenza del DNA e alcuni algoritmi personalizzati per trovare correlazioni tra le tue corrispondenze di DNA. Ora puoi vedere come le tue corrispondenze sono correlate tra loro in una visualizzazione facilmente ricercabile. Corrispondenze per cluster ti aiuta a passare rapidamente dal campione di saliva alla scoperta della storia familiare focalizzandosi su quale linea (o antenati) di discendenza tu e le tue corrispondenze di DNA condividete.

Vuoi saperne di più sulla scienza alla base di questa nuova funzione? Continua a leggere.
Mappatura delle correlazioni di corrispondenze DNA
Le corrispondenze per cluster organizzano le tue corrispondenze di DNA in base a come sono correlate tra loro. Per fare questo, iniziamo mappando le correlazioni tra le tue corrispondenze e tutte le loro corrispondenze. Questo tiene traccia di come siete tutti correlati e di quanto DNA condividete.
Nell’esempio seguente, un membro di AncestryDNA è rappresentato da un cerchio blu e i cerchi arancioni rappresentano tutte le loro corrispondenze di DNA. Sono collegati da linee che indicano quanto DNA condividono. Più breve è la linea, più DNA condividono e più vicina è la correlazione. Più lunga è la linea, meno DNA condividono e più lontana è la corrispondenza. (Quando gli scienziati parlano di questo tipo di mappe li chiamano “reti”, e si riferiscono ai cerchi come “nodi” e le linee come “bordi”. Per saperne di più su questa scienza, consulta il nostro white paper sui viaggi ancestrali.)

Figura 1. Un esempio di come le corrispondenze del DNA possono essere mappate e collegate. Il cerchio centrale (blu) è il membro di AncestryDNA e i cerchi esterni (arancione) sono le corrispondenze del DNA di quella persona nel database di Ancestry. Sono collegati da linee che rappresentano quanto DNA condividono. Le linee più corte rappresentano più DNA condiviso e, quindi, una corrispondenza più ravvicinata.
Tuttavia, l’utilizzo di tutte le tue corrispondenze può rendere la mappa delle connessioni del DNA molto grande e pieno di corrispondenze che non sono genealogicamente significative. Quindi, facciamo alcune azioni ulteriori per restringere le corrispondenze che usiamo. Di seguito è riportata un’illustrazione semplificata del processo.

Figura 2. I passaggi principali per la mappatura delle connessioni di corrispondenza del DNA per il clustering. In primo luogo, rimuoviamo i parenti stretti e le corrispondenze più lontane dei terzi cugini (arancione chiaro) e quindi mappiamo le tue corrispondenze con loro. In secondo luogo, determiniamo come le tue corrispondenze sono collegate tra loro. Quindi, separiamo le tue corrispondenze nei due lati della tua famiglia: materna e paterna. Infine, raggruppiamo le corrispondenze nei loro cluster.
In primo luogo, rimuoviamo i tuoi parenti più stretti (come genitori, fratelli, fratellastri, zie/zii e nipoti di zii) e le corrispondenze più lontane dei terzi cugini. Può sembrare strano, ma includere le corrispondenze ravvicinate può effettivamente rendere i tuoi cluster meno significativi. Poiché tu e i tuoi parenti stretti condividete più antenati, includerli potrebbe offuscare i bordi e portare a un grande cluster di corrispondenze.
Ad esempio, i tuoi fratelli sono ugualmente legati a tutti e quattro i tuoi nonni e ai loro discendenti. Se includessimo i tuoi fratelli nel clustering, si comporterebbero come un grande magnete e attirerebbero in un unico cluster tutte le tue zie, zii e cugini. Il risultato non sarebbe molto interessante da osservare o utile. Concentrandoci sulle corrispondenze tra cugini di 1° e 3° grado (persone con cui condividi tra 65cM e 1.300cM di DNA), possiamo formare più cluster che sono più piccoli e più informativi. Questi cluster spesso contengono corrispondenze che condividono un antenato con te a livello di nonno/a o bisnonno/a.
Successivamente, espandiamo la mappa determinando come le tue corrispondenze sono collegate tra loro. Più le corrispondenze sono collegate tra loro, più facile è organizzarle in cluster che rappresentano diverse linee di discendenza. Allo stesso tempo, aggiungere troppe corrispondenze lontane può rendere più difficile identificare cluster chiari e significativi. Spesso, la maggior parte delle corrispondenze lontane sono più il risultato di persone discendenti da una popolazione comune. Questo può creare molte connessioni tra le persone e interrompere il clustering, in un modo che non sia informativo sulla storia della tua famiglia. Dopo una serie di esperimenti, abbiamo trovato un buon equilibrio tralasciando le corrispondenze che sono troppo lontanamente correlate, che condividono meno di 20cM di DNA tra loro.
Infine, utilizziamo la tecnologia SideView per separare la mappa delle tue corrispondenze in due lati, che rappresentano le corrispondenze di ciascun lato della tua famiglia, materno e paterno. Questo ci aiuta a creare cluster più accurati. Le corrispondenze “non assegnate” non vengono inserite in un cluster. Poiché non sappiamo a quale linea di discendenza appartengono, non vogliamo rovinare l’accuratezza dei tuoi cluster.
Creazione di un cluster con le tue corrispondenze
Una volta mappato il modo in cui le tue corrispondenze di DNA sono correlate a te e tra loro, usiamo programmi per computer chiamati algoritmi di clustering per trovare le serie di corrispondenze più correlate tra loro che alle tue altre corrispondenze. A livello tecnico, gli algoritmi di clustering trovano sottoinsiemi di corrispondenze fortemente correlati. Tornando alla nostra illustrazione sopra, questo sembrerebbe un insieme di punti collegati tra loro da molte linee e separati da altri gruppi di punti. Per saperne di più su un tipo di algoritmo di clustering, chiamato metodo Louvain, consulta il nostro white paper sui viaggi ancestrali.
Ci sono molti diversi metodi di clustering, ognuno con i propri punti di forza e di debolezza. Per risultati migliori, ne usiamo diversi e confrontiamo i loro risultati. Questo approccio è chiamato strategia di ensemble. Applichiamo anche regole aggiuntive su quanto le persone siano strettamente correlate durante l’esecuzione del clustering. Questo aiuta a gestire relazioni complesse create dall’endogamia o dal collasso della tavola genealogica, in cui le persone sono collegate in più di un modo.
Il risultato? Cluster chiari e organizzati da ogni lato della tua famiglia. Puoi esplorare questi cluster, vedere come le tue corrispondenze sono collegate e scoprire nuove relazioni familiari.

Figura 3. Un esempio dei risultati di Corrispondenze per cluster Ogni quadrato colorato indica un caso in cui due corrispondenze di DNA di una persona condividono anche il DNA tra loro. I cluster sono stati codificati a colori e rappresentano individui che probabilmente condividono un antenato comune. I quadrati vuoti indicano dove due individui non condividono almeno 20cM di DNA. I quadrati grigi indicano dove due individui condividono il DNA, ma non sono raggruppati nello stesso cluster.
È il tuo turno per esplorare
Una volta che i cluster di corrispondenze sono pronti, puoi esplorare ciascuno di essi per scoprire quali antenati comuni tali corrispondenze condividono. Fai clic su qualsiasi punto nei cluster per visualizzare le informazioni sulle corrispondenze o scorri la pagina verso il basso per visualizzare l’elenco dei membri di ciascun cluster.
Corrispondenze per cluster ti aiuta a visualizzare come le tue corrispondenze sono correlate facendole organizzare davanti ai tuoi occhi. Puoi utilizzare questi dati per identificare gli antenati condivisi e le loro linee di discendenza correlate, anche se non hai documenti storici per mostrare come sono correlate.
Se sei curioso di imparare a sfruttare al meglio i tuoi cluster, dai un’occhiata ai nostri post correlati e agli eventi virtuali.
*Alcune funzioni del DNA richiedono un abbonamento ad Ancestry Pro Tools. Alcuni membri non potranno accedere a questa funzionalità fino a dicembre 2025.