MDS-анализ генетической вариативности американских популяций

В декабре прошлого года я занимался анализом аутосомных SNP-ов около трех десятков групп аборигенного народонаселения, проживающих в Новом Свете. Вот эти популяции:

Mexican
Colombian
Dominican
Ecuadorian
PuertoRican
Bolivian
Totonac
Aleut
Athabask
Navajo
Apache
Mixtec
Huichol
Cochimi
Cucupa
Kumiai
Luiseno
Costanoan    
Lumbee
Tlingit
Haida
Eskimo
Miwok
Serrano
Colville 
Inuit-West

Inuit-East

Inuit-West
Tsimsian
Pima
Maya
Karitiana
Surui
Caribbean_Hispanic

В программе Plink были произведены расчеты вариативности этих популяции; позднее эти расчеты были представлены в виде MDS-графика, отображающего взаимное расположение основных популяций Нового Света (за исключением потомков европейцев)  в пространстве первых двух главных генетических векторов, определенных статистическими методами мульти-дименсионального шкалирования.

mdsplot

 

 

test

 

Так как поставленная задача была довольно проста, то и  решилась она тривиальным способом за счет:

  1. включения в выборку генотипов 47 американских афро-американцев США из афро-американской панели проекта HapMap (ASW)
  2. увеличения числа снипов до 190 000.

Новый MDS плот образовал классическую правильную V-образную форму. Такая форма MDS и  PСA-графиков свидетельствует о том, что набор снипов обладает высокими дискриминантными свойствами за счет значимых величин Fst. Иными словами, имеющийся набор снипов дает высокую степень резолюции в определении генетической структуры различных групп народонаселения, которые в свою очередь объединяются в различные кластеры.

 

Собственно говоря, в более правильном виде, вилка американских популяций должна образовать треугольник, в одном углу которого должны располагаться потомки европейских переселенцев; в другом углу – нативное население Америк (америнды); а в третьем – потомки африканских народов.
Таким образом, положение любого индивида, имеющего относительно давние корни в Новом Свете внутри означенного треугольника будет указывать на степень его моно-,би-, и трирасовости.

В основу нашей гипотезы было положено предложение Тони Фрудакиса («Molecular Photofitting. Predicting Ancestry and Phenotype Using DNA») насчет отображения структуры генофонда жителей США в виде треугольника.

Genetic triangle
С целью проверки своей гипотезы о формировании классического треугольника популяционной дивергенции, я добавил в выборку генотипы (1,5 миллиона снипов) 50 мормонов из панели CEU (Utah residents with Northern and Western European ancestry from the CEPH collection). Из нового графика MDS наглядно следует,  что наша  гипотеза нашла свое подтверждение.

mds2

Именно по этой  причине, созданный нами калькулятор MDLP является самым точным из имеющихся в свободном доступе инструментов для обнаружения присутствия компонентов Native American и Afro-American в геноме современных коренных жителей Нового Света.

В качестве дополнительной верификации гипотезы был проведен анализ генетической вариативности популяций Нового Света по методу главных компонент (использовалась та же самая выборка в формате Eigenstrat в программе Eigensoft 4.0). Метод главных компонент дал аналогичную картину:
PCA

 

Реклама

Добавить комментарий

Please log in using one of these methods to post your comment:

Логотип WordPress.com

Для комментария используется ваша учётная запись WordPress.com. Выход / Изменить )

Фотография Twitter

Для комментария используется ваша учётная запись Twitter. Выход / Изменить )

Фотография Facebook

Для комментария используется ваша учётная запись Facebook. Выход / Изменить )

Google+ photo

Для комментария используется ваша учётная запись Google+. Выход / Изменить )

Connecting to %s