この演習の目標は、RNAの配列をタンパク質に翻訳することです。
RNA鎖は、コドンと呼ばれる3つのヌクレオチドからなる配列でできています。それぞれのコドンは、1つのアミノ酸に翻訳されます。それらのアミノ酸がつながると、タンパク質になります。
実際には、コドンは64種類あり、それらは20種類のアミノ酸に対応しています。ただし、この演習で使うのは、その64種類のうちのほんの一部だけです。使うものは次のとおりです。
| コドン | アミノ酸 |
|---|---|
| AUG | Methionine |
| UUU, UUC | Phenylalanine |
| UUA, UUG | Leucine |
| UCU, UCC, UCA, UCG | Serine |
| UAU, UAC | Tyrosine |
| UGU, UGC | Cysteine |
| UGG | Tryptophan |
| UAA, UAG, UGA | STOP |
たとえば、RNAの文字列「AUGUUUUCU」には「AUG」「UUU」「UCU」という3つのコドンがあります。これらはそれぞれMethionine、Phenylalanine、Serineに対応します。
上の表を見ると、「STOP」コドンが3つあることがわかります。これらのコドンのいずれかに出会ったら、それ以降の配列は無視します。タンパク質はそこで完成しているからです。
たとえば、「AUGUUUUCUUAAAUG」には「STOP」コドン(「UAA」)が含まれています。その時点に達したら、そこで処理をやめます。したがって、考えるのはその手前の部分(つまり「AUGUUUUCU」)だけで、それより後ろのコドン(つまり「AUG」)は使いません。
もっと詳しく知りたい場合は、Wikipediaのタンパク質の翻訳を参照してください。