Parfois, il est impossible de lire un marqueur ou un emplacement particulier dans votre ADN. Cela n’est généralement pas nécessaire pour trouver des parents ou pour obtenir l’estimation de vos origines ethnique, mais cela peut affecter les résultats de vos traits.
Heureusement, la biologie peut nous aider.
Comme dans un jeu où vous devinez les lettres manquantes d’un mot en examinant les lettres que vous avez en main, nous pouvons déduire un marqueur manquant en fonction de l’ADN qui l’entoure. Les scientifiques appellent cela « l’imputation ».
Comment ça marche
Deux faits concernant notre ADN rendent l’imputation possible.
Le premier est que les centaines de milliers de marqueurs que nous examinons sont alignés, les uns après les autres, sur de longs morceaux d’ADN appelés chromosomes. Le deuxième est que nous avons tendance à hériter de nos parents des segments d’ADN (plutôt que des marqueurs individuels).
Cela signifie que lorsque nous recevons d’un parent biologique un marqueur pour, par exemple, le cérumen sec, nous recevons également beaucoup de marqueurs qui entourent ce marqueur de cérumen. En d’autres termes, nous recevons un segment de marqueurs qui incluent le cérumen sec.
Comme dans l’exemple ci-dessus, vous pouvez probablement déduire que la lettre manquante est Ê et que le mot est « ancêtre ». Imaginez maintenant que le Ê est le marqueur pour le cérumen sec. Même si nous ne voyons pas le Ê dans notre analyse, nous pouvons le déduire en examinant les marqueurs qui l’entourent.
Le marqueur pour le cérumen humide aura différentes lettres autour de lui. Imaginez que c’est le T dans le mot « fortune ». Donc, si pour une raison quelconque nous ne pouvons pas lire le marqueur de cérumen, nous pouvons examiner les marqueurs qui l’entourent. Si nous voyons ANC_TRE, nous pouvons alors déduire que cette personne a le marqueur de cérumen sec. Et si nous voyons FOR_TUNE, nous pouvons alors déduire que cette personne a le marqueur de cérumen humide.
L’alphabet de l’ADN
Bien sûr, l’ADN ne contient pas de mots, mais il contient une sorte d’alphabet composé de 4 lettres : A, C, G et T.
Au marqueur pour le cérumen, rs17822931, le cérumen sec est un T et le cérumen humide est un C. Si nous ne pouvons pas lire la lettre à rs17822931, nous pouvons la déduire des marqueurs environnants.
Voici un exemple concret d’imputation. Il ne montre que quelques-uns des marqueurs autour du marqueur de cérumen, mais il vous donne une idée de la façon dont les choses fonctionnent.
Voici quelques-uns des marqueurs autour du marqueur de cérumen sec (marqué en rouge) :
Voici quelques-uns des marqueurs autour le cérumen marqueur de cérumen sec (marqué en rouge) :
Imaginez que nous ne pouvons pas lire le marqueur de cérumen mais que nous voyons ce qui suit :
D’après vous, quel est le marqueur maquant ? Si vous pensez au cérumen sec, vous avez raison !
Quel est le degré de précision de l’imputation ?
Bien que fiable, l’imputation a toujours un taux d’erreur plus élevé que la simple lecture de l’ADN. Il y a plusieurs raisons pour cela.
Par exemple, les marqueurs environnants sont parfois trop similaires et donc difficiles à différencier. Ou, si le marqueur que nous ne pouvons pas lire est proche d’une extrémité d’un chromosome, il se peut qu’il n’y ait des marqueurs que d’un seul côté. Ce ne sont là que quelques-unes des façons dont l’imputation peut parfois être moins fiable que la lecture directe de l’ADN. Ces problèmes rendent particulièrement difficile l’attribution de marqueurs pour trois de nos traits : les cheveux roux, les taches de rousseur et l’odeur des asperges dans votre urine.