33
© Dunod – Toute reproduction non autorisée est un délit.
4
RECHERCHE DANS LES
BANQUES
La recherche dans les banques peut être considérée comme un mode d’interrogation
de séquences alternatif au mode par annotation (traité au chapitre 2).
4.1 SCORE DE SIMILITUDE ENTRE SÉQUENCES
Afin de pouvoir comparer des alignements différents de séquences ou de comparer
des scores entre séquences à l’issue d’une recherche de ressemblance dans une
banque, il est important de savoir comment calculer un score de similitude et surtout
de savoir si un score obtenu est significatif. Le pourcentage d’identité (%Id) est le
nombre d’identité entre deux séquences après alignement des séquences rapporté à
la longueur de l’alignement. Ainsi pour deux séquences données, le pourcentage
d’identité dépend de l’alignement.
Exemples
S1
DDLSKQAVAYRQMSLLLRG
S2
DGKTAVATDTILLLQG
*
*
Id% =(2/19)×100 = 11 %
S1
DDLSKQAVAYRQMSLLL-RG
S2
-D-GKTAVA-TDTILLLQG* * ***
***
Id% =(8/20) × 100 = 40 %
PLAN
4.1 Score de similitude entre séquences
4.2 Recherche globale ou locale
4.3 Algorithme FASTA (FAST Alignment)
4.4 Algorithme BLAST (Basic Local Alignment Search Tool)
OBJECTIFS
➤ Comprendre les scores de similitude entre séquences
➤ Choisir une méthode de recherche locale ou globale
➤ Connaître le principe de FASTA et ses heuristiques
➤ Connaître le principe de BLAST et ses limitations
Précédent

- 45/216

Suivant