RNA 서열을 단백질로 번역해요.
RNA는 코돈이라고 하는 세 개의 뉴클레오타이드 서열로 나눌 수 있고, 그다음 다음과 같이 폴리펩타이드로 번역돼요:
RNA: "AUGUUUUCU" => 번역하면
코돈: "AUG", "UUU", "UCU"
=> 다음 서열의 폴리펩타이드가 돼요 =>
단백질: "Methionine", "Phenylalanine", "Serine"
코돈은 64개이고, 이들은 다시 20개의 아미노산에 대응해요. 하지만 이 연습 문제에서 모든 코돈 서열과 그에 따른 아미노산이 다 중요한 건 아니에요. 코돈 하나에 대해 잘 동작한다면, 프로그램은 모든 코돈에 대해서도 동작해야 해요. 다만 테스트 스위트의 목록을 확장해서 전부 포함시켜도 좋아요.
종결 코돈('STOP' 코돈이라고도 해요)도 세 개 있어요. 이런 코돈을 (리보솜이) 만나면 번역이 모두 끝나고 단백질이 종결돼요.
그 뒤에 오는 모든 코돈은 무시돼요. 이렇게요:
RNA: "AUGUUUUCUUAAAUG" =>
코돈: "AUG", "UUU", "UCU", "UAA", "AUG" =>
단백질: "Methionine", "Phenylalanine", "Serine"
정지 코돈 "UAA"가 번역을 끝내고, 마지막 메싸이오닌은 단백질 서열로 번역되지 않는다는 점에 주목해요.
아래는 이 연습 문제에 필요한 코돈과 그에 따른 아미노산이에요.
| 코돈 | 단백질 |
|---|---|
| AUG | Methionine |
| UUU, UUC | Phenylalanine |
| UUA, UUG | Leucine |
| UCU, UCC, UCA, UCG | Serine |
| UAU, UAC | Tyrosine |
| UGU, UGC | Cysteine |
| UGG | Tryptophan |
| UAA, UAG, UGA | STOP |
위키백과에서 단백질 번역에 대해 더 알아봐요.