Key points are not available for this paper at this time.
Une approche simple pour scanner rapidement une grande base de données de séquences protéiques à la recherche d'homologie est décrite. L'approche utilisée est strictement dépendante de l'organisation de la base de données. Une base de données a été compilée dans laquelle les séquences protéiques sont regroupées en familles de protéines étroitement liées, chaque famille étant caractérisée par sa composition moyenne en dipeptides. Une nouvelle entrée dans la base de données peut être allouée à une famille en comparant sa composition en dipeptides avec la composition moyenne en dipeptides des familles.
Pasquale Petrilli (Fri,) a étudié cette question.