Bases de Données d'Expression Génique : GEO et ArrayExpress
Les bases de données d'expression génique archivent et distribuent les données de transcriptomique issues de puces à ADN et de séquençage pour une réutilisation publique.
BioinformatiqueBases de Données NCBI : GenBank, RefSeq et SRA
Le Centre National d'Information Biotechnologique héberge des bases de données essentielles pour les séquences nucléotidiques, les génomes et les archives de lectures de séquençage.
BioinformatiqueBases de Données de Voies et Ontologies : KEGG, GO et Reactome
Les bases de données de voies et d'ontologies organisent systématiquement les connaissances biologiques sur les fonctions moléculaires, les processus cellulaires et les voies métaboliques.
BioinformatiqueUniProt et les Bases de Données de Séquences Protéiques
UniProt fournit une ressource complète pour les séquences protéiques et l'annotation fonctionnelle, intégrant des données de nombreuses sources.
BioinformatiqueBases de Données de Variation : dbSNP, ClinVar et COSMIC
Les bases de données de variation cataloguent les variants génétiques dans les populations et leurs associations avec les maladies, la réponse aux médicaments et les phénotypes.
BioinformatiqueClustering en Bioinformatique : Découvrir des Groupes Naturels
Les algorithmes de clustering regroupent des échantillons ou caractéristiques biologiques similaires sans étiquettes pour découvrir des sous-types, des modules de gènes et des profils d'expression.
BioinformatiqueApprentissage Profond pour la Bioinformatique
L'apprentissage profond utilise des réseaux de neurones multicouches pour modéliser des relations biologiques complexes dans les données de séquences, de structures et d'images.
BioinformatiqueSélection de Caractéristiques en Bioinformatique
Identifier les caractéristiques biologiques les plus informatives améliore les performances du modèle, réduit le surajustement et améliore l'interprétabilité.
BioinformatiqueModèles de Markov Cachés en Bioinformatique
Les modèles de Markov cachés sont des modèles statistiques pour données séquentielles avec des états non observés, largement utilisés dans l'analyse de séquences biologiques.
Bioinformatique