Structure des protéinesLa structure des protéines est la composition en acides aminés et la conformation en trois dimensions des protéines. Elle décrit la position relative des différents atomes qui composent une protéine donnée. Les protéines sont des macromolécules de la cellule, dont elles constituent la « boîte à outils », lui permettant de digérer sa nourriture, produire son énergie, de fabriquer ses constituants, de se déplacer, etc. Elles se composent d'un enchaînement linéaire d'acides aminés liés par des liaisons peptidiques.
Alignement de séquencesEn bio-informatique, l'alignement de séquences (ou alignement séquentiel) est une manière de représenter deux ou plusieurs séquences de macromolécules biologiques (ADN, ARN ou protéines) les unes sous les autres, de manière à en faire ressortir les régions homologues ou similaires. L'objectif de l'alignement est de disposer les composants (nucléotides ou acides aminés) pour identifier les zones de concordance. Ces alignements sont réalisés par des programmes informatiques dont l'objectif est de maximiser le nombre de coïncidences entre nucléotides ou acides aminés dans les différentes séquences.
Domaine protéiqueredresse=1.15|vignette|Exemples de structures de protéines organisées en domaines distincts. Le domaine de couleur brique, appelé domaine PH, est commun aux deux protéines,. Sa fonction est de fixer le phosphatidylinositol-3,4,5-trisphosphate (PIP3) Un domaine protéique est une partie d'une protéine capable d'adopter une structure de manière autonome ou partiellement autonome du reste de la molécule. C'est un élément modulaire de la structure des protéines qui peuvent ainsi être composées de l'assemblage de plusieurs de ces domaines.
Multiple sequence alignmentMultiple sequence alignment (MSA) may refer to the process or the result of sequence alignment of three or more biological sequences, generally protein, DNA, or RNA. In many cases, the input set of query sequences are assumed to have an evolutionary relationship by which they share a linkage and are descended from a common ancestor. From the resulting MSA, sequence homology can be inferred and phylogenetic analysis can be conducted to assess the sequences' shared evolutionary origins.
Séquence conservéeEn biologie de l'évolution, les séquences conservées sont des séquences d'acides nucléiques (ADN et ARN) ou d'acide aminés identiques ou similaires au sein d'un génome (on parle alors de séquences paralogues) ; à travers les espèces (on parle alors de séquences orthologues), ou bien encore entre un taxon donneur et un taxon récepteur (on parle alors de séquences xénologues). La conservation indique qu'une séquence a été maintenue par la sélection naturelle.
Séquence consensusEn biologie moléculaire et en bioinformatique, une séquence consensus est la séquence nucléotidique ou la séquence peptidique la plus fréquente à chaque position d'un alignement de séquences. Elle représente le résultat d'alignements de séquences multiples dans lesquelles les séquences apparentées sont comparées les unes aux autres afin de déterminer les motifs les plus fréquents. Cette information est importante pour les protéines dépendantes des séquences nucléotidiques, telles que les ARN polymérases.
Pfamvignette|Logo de la Pfam. Pfam est une base de données bio-informatique de familles de protéines qui classe diverses propriétés des domaines protéiques sur la base de leurs . Créée en 1997 par les bio-informaticiens Erik Sonnhammer de l'institut Karolinska à Stockholm, Sean Eddy de l'université Washington à Saint-Louis (Missouri) et Richard Durbin du centre Sanger à Cambridge, elle fournit notamment des informations sur l'architecture des domaines protéiques, leur distribution parmi les espèces vivantes, les liens vers d'autres bases de données et les structures connues de protéines de ces familles.
Recombinaison homologuethumb | 275px | alt=Schéma du chromosome 1 après recombinaison homologue | Figure 1. La recombinaison homologue peut produire de nouvelles combinaisons d'allèles entre les chromosomes parentaux, notamment lors de la méiose.La recombinaison homologue est un type de recombinaison génétique où les séquences de nucléotides sont échangées entre des molécules d'ADN identiques (homologues) ou similaires (Figure 1). Au sens large, la recombinaison homologue est un mécanisme ubiquitaire de réparation des cassures double-brins de l'ADN.
Sequence logoIn bioinformatics, a sequence logo is a graphical representation of the sequence conservation of nucleotides (in a strand of DNA/RNA) or amino acids (in protein sequences). A sequence logo is created from a collection of aligned sequences and depicts the consensus sequence and diversity of the sequences. Sequence logos are frequently used to depict sequence characteristics such as protein-binding sites in DNA or functional units in proteins. A sequence logo consists of a stack of letters at each position.
Doigt de zincthumb|Dessin représentant le doigt de zinc Cys2His2, consistant en une hélice alpha et un feuillet bêta aux brins antiparallèles. L'ion zinc est en vert, complexé à deux histidines (en bas) et deux cystéines (en haut, soufre en doré) Les doigts de zinc sont de petits motifs structuraux trouvés dans les protéines et capables d'ordonner en complexe un ou plusieurs ions zinc pour stabiliser leur repliement.