Traducteur ADN vers protéine - Convertisseur de codons et d'acides aminés
Traduisez une séquence d'ADN ou d'ARN en acides aminés selon le code génétique standard. Choisissez un cadre de lecture et visualisez chaque codon traduit.
Traducteur ADN vers protéine
Entrez une séquence d'ADN ou d'ARN. Utilisez les bases A, C, G et T. U est lu comme T. Les espaces, sauts de ligne et chiffres sont ignorés. La traduction utilise le code génétique standard (table NCBI 1).
Commencer la traduction au premier ATG de ce cadre de lecture, comme un ribosome qui commence la lecture d'un cadre ouvert de lecture, plutôt qu'au tout début du cadre.
Documentation
Un traducteur ADN vers protéine convertit une séquence d'ADN ou d'ARN en la chaîne d'acides aminés qu'elle code, selon le code génétique standard. Il lit la séquence trois bases à la fois et recherche chaque triplet dans une table fixe de 64 codons.
Comment fonctionne la traduction
Un gène s'écrit avec quatre lettres : A, C, G et T (ou U pour l'ARN). Les cellules lisent ces lettres par groupes de trois non chevauchants, appelés codons. Chaque codon représente un acide aminé, ou un signal stop qui termine la chaîne.
Cet outil nettoie d'abord l'entrée. Il convertit les lettres minuscules en majuscules, supprime les espaces, les sauts de ligne et les chiffres, et remplace chaque U par un T, car l'uracile de l'ARN forme le même codon que la thymine de l'ADN. Il rejette ensuite tout caractère qui n'est pas A, C, G ou T, comme les codes d'ambiguïté tels que N, afin qu'une séquence ne soit jamais mal traduite en silence.
Le code génétique standard
L'outil utilise la table de traduction 1 du NCBI, « le code standard », le code génétique utilisé par la plupart des organismes, y compris l'être humain. Il attribue à chacun des 64 codons possibles l'un des 20 acides aminés ou un signal stop.
Trois codons sont des codons stop : TAA, TAG et TGA. Aucun d'eux ne code pour un acide aminé. Quand l'outil en atteint un, il termine la traduction à cet endroit. Le codon stop lui-même n'est pas ajouté à la protéine, et les bases qui le suivent sont ignorées.
Le codon ATG code pour la méthionine (Met, M). Chez la plupart des organismes, ATG joue aussi le rôle de codon start, le codon où un ribosome commence la lecture d'un gène.
Cadres de lecture
Une séquence d'ADN peut être lue de trois façons différentes, appelées cadres de lecture, selon la base à partir de laquelle on commence à compter :
- Le cadre 1 commence à la première base.
- Le cadre 2 commence à la deuxième base, en sautant la première.
- Le cadre 3 commence à la troisième base, en sautant les deux premières.
Décaler le cadre d'une seule base change tous les codons qui suivent, si bien que la même séquence peut produire trois chaînes d'acides aminés totalement différentes. Un seul cadre correspond en général au véritable cadre codant d'un gène.
Recherche du premier codon start
Par défaut, l'outil traduit à partir de la première base du cadre choisi, quel que soit ce codon. Cela correspond au fonctionnement habituel de l'outil et convient pour traduire une séquence dont on sait déjà qu'elle est en phase dès la première position.
L'option « rechercher le premier codon start » change le point de départ de la traduction, pas la façon dont elle traduit. Une fois activée, l'outil parcourt le cadre choisi à la recherche du premier codon ATG et commence la traduction à cet endroit, en ignorant les bases qui le précèdent. Cela reproduit la façon dont un ribosome trouve le début d'un cadre ouvert de lecture (ORF) plutôt que de traduire à partir d'un point arbitraire dans une séquence plus longue. Si aucun ATG n'existe dans ce cadre, l'outil signale qu'aucun codon start n'a été trouvé plutôt que de deviner.
Désactiver l'option revient au comportement d'origine : la traduction commence au tout début du cadre.
Comment calculer une traduction d'ADN en protéine
- Entrez une séquence d'ADN ou d'ARN. Les espaces, les sauts de ligne, les chiffres et les caractères de type FASTA sont ignorés automatiquement.
- Choisissez un cadre de lecture : 1, 2 ou 3.
- Activez éventuellement « rechercher le premier codon start » pour commencer au premier ATG dans le cadre plutôt qu'au début du cadre.
- L'outil lit la séquence trois bases à la fois, recherche chaque codon dans le code génétique standard, et s'arrête au premier codon stop.
- Le résultat est la séquence protéique, écrite avec les codes d'acides aminés à une lettre, accompagnée du détail codon par codon.
Exemple travaillé
Séquence : ATGGCCTAA, cadre de lecture 1, recherche du codon start désactivée.
| Position | Codon | Acide aminé |
|---|---|---|
| 1 | ATG | Met (M) |
| 2 | GCC | Ala (A) |
| 3 | TAA | Stop |
La protéine est MA. La traduction s'arrête à TAA, donc rien après ce codon n'est lu.
Prenons maintenant une séquence plus longue, CCCATGGCCTAA, dans le cadre 1. Recherche désactivée, l'outil lit à partir de la toute première base : CCC (Pro), ATG (Met), GCC (Ala), puis TAA (stop), ce qui donne la protéine PMA. Recherche activée, l'outil saute CCC, commence au premier ATG, et lit ATG (Met), GCC (Ala), puis TAA (stop), ce qui donne la protéine MA. Les deux résultats sont corrects pour la même séquence ; ils répondent à des questions différentes, l'un lisant tout le cadre, l'autre ne lisant que le cadre ouvert de lecture qui commence à ATG.
Questions fréquentes
Qu'est-ce qu'un codon ?
Un codon est un groupe de trois bases d'ADN ou d'ARN. Chacun des 64 codons possibles représente un acide aminé ou un signal stop, selon le code génétique standard.
Pourquoi la traduction s'arrête-t-elle à un codon stop ?
TAA, TAG et TGA ne codent pour aucun acide aminé. Ce sont des signaux stop. Un ribosome qui lit un gène réel libère la chaîne protéique achevée à cet endroit, donc l'outil fait de même et ignore les bases qui suivent.
Qu'est-ce qu'un cadre de lecture, et pourquoi est-ce important ?
C'est le point de départ utilisé pour découper une séquence en codons. Commencer une ou deux bases plus loin change tous les codons qui suivent, si bien que le même ADN peut être lu de trois façons différentes, dont une seule correspond en général à la véritable séquence codante.
Que change l'option « rechercher le premier codon start » ?
Elle change le point de départ de la traduction, pas le code génétique utilisé. Activée, l'outil avance dans le cadre choisi jusqu'au premier ATG et traduit à partir de là, comme un ribosome qui commence à un codon start. Désactivée, la traduction commence à la toute première base du cadre.
Puis-je coller une séquence d'ARN ?
Oui. L'outil traite U comme T, car l'uracile de l'ARN et la thymine de l'ADN correspondent au même codon. Les lettres majuscules et minuscules sont toutes deux acceptées.
Que se passe-t-il si ma séquence contient des lettres autres que A, C, G, T ou U ?
L'outil signale les caractères invalides et ne traduit pas la séquence. Cela inclut les codes d'ambiguïté comme N, fréquents dans les données de séquençage de faible qualité mais non valides en entrée de traduction.
Que se passe-t-il si la longueur de la séquence n'est pas un multiple de trois ?
L'outil traduit tous les codons complets qu'il peut former et signale séparément la ou les bases restantes, sans deviner ce qu'elles pourraient coder.