نبذة مختصرة : L’avènement du séquençage métagénomique aléatoire a révolutionné la microbiologie en permettant la caractérisation sans culture préalable de communautés microbiennes complexes telles que le microbiote intestinal humain. Des outils bioinformatiques récemment développés atteignent une résolution au niveau de la souche en recensant des gènes accessoires ou en capturant des variants nucléotidiques (SNPs). Toutefois, ces outils sont limités par l’étendue des génomes de référence disponibles qui sont loin de couvrir toute la variabilité microbienne. En effet, de nombreuses espèces n’ont pas encore été séquencées ou sont représentées par seulement quelques génomes.La création de catalogues de gènes non redondants par assemblage de novo suivie du regroupement des gènes co-abondants révèlent une partie de la matière noire microbienne en reconstituant le répertoire de gènes d’espèces potentiellement inconnues. Bien que les méthodes existantes identifient avec précision les gènes core présents dans toutes les souches d’une espèce, elles omettent de nombreux gènes accessoires ou les divisent en petits groupes de gènes qui ne sont pas associés aux core génomes. Or, capturer ces gènes accessoires est indispensable en recherche clinique et épidémiologique car ces derniers assurent des fonctions spécifiques à certaines souches telles que la pathogénicité ou la résistance aux antibiotiques.Lors de cette thèse, nous avons développé MSPminer, un logiciel performant qui reconstitue et structure des pan-génomes d’espèces métagénomiques (ou MSPs pour Metagenomic Species Pan-genomes) en regroupant les gènes co-abondants dans un ensemble d’échantillons métagénomiques. MSPminer s’appuie sur une nouvelle mesure robuste de la proportionnalité couplée à un classificateur empirique pour regrouper et distinguer les gènes core mais aussi les gènes accessoires des espèces microbiennes.Grâce à MSPminer, nous avons structuré un catalogue de 9,9 millions de gènes du microbiote intestinal humain en 1 661 MSPs. L’homogénéité de l’annotation ...
No Comments.