आपको RNA सीक्वेंस का प्रोटीन में अनुवाद करना है।
RNA की लड़ियाँ तीन न्यूक्लियोटाइड वाले सीक्वेंस से बनी होती हैं, जिन्हें कोडॉन कहा जाता है। हर कोडॉन एक अमीनो अम्ल में अनुवादित होता है। ये अमीनो अम्ल आपस में जुड़कर एक प्रोटीन बनाते हैं।
वास्तविक जीवन में 64 कोडॉन होते हैं, जो बदले में 20 अमीनो अम्लों के अनुरूप होते हैं। लेकिन इस अभ्यास में आप इन 64 में से कुछ ही इस्तेमाल करेंगे। वे नीचे दिए गए हैं:
| कोडॉन | अमीनो अम्ल |
|---|---|
| AUG | Methionine |
| UUU, UUC | Phenylalanine |
| UUA, UUG | Leucine |
| UCU, UCC, UCA, UCG | Serine |
| UAU, UAC | Tyrosine |
| UGU, UGC | Cysteine |
| UGG | Tryptophan |
| UAA, UAG, UGA | STOP |
उदाहरण के लिए, RNA स्ट्रिंग “AUGUUUUCU” में तीन कोडॉन हैं: “AUG”, “UUU” और “UCU”। ये Methionine, Phenylalanine और Serine से मेल खाते हैं।
ऊपर दी गई तालिका में आप देखेंगे कि तीन “STOP” कोडॉन हैं। अगर आपको इनमें से कोई कोडॉन मिले, तो सीक्वेंस के बाकी हिस्से को छोड़ दीजिए। प्रोटीन वहीं पूरा हो जाता है।
उदाहरण के लिए, “AUGUUUUCUUAAAUG” में एक STOP कोडॉन (“UAA”) है। जैसे ही हम उस कोडॉन तक पहुँचते हैं, हम वहीं रुक जाते हैं। इसलिए हम उससे पहले वाले हिस्से को ही लेते हैं (यानी “AUGUUUUCU”), उसके बाद आने वाले किसी भी कोडॉन (यानी “AUG”) को नहीं।
प्रोटीन अनुवाद के बारे में विकिपीडिया पर और पढ़िए।
लीनियर मेमोरी के बाइट 1024-1279 इनपुट स्ट्रिंग के लिए आरक्षित हैं।
चाहें तो इनपुट स्ट्रिंग को वहीं बदला जा सकता है।
कोडॉन एक स्ट्रिंग के रूप में, बिना पैडिंग के, जोड़कर दिए जाते हैं।
प्रोटीन अनुक्रम को नल-टर्मिनेटेड स्ट्रिंग के रूप में आउटपुट कीजिए, जिसमें हर प्रोटीन के बाद एक न्यूलाइन अक्षर हो।
उदाहरण के लिए, एक आउटपुट इस तरह होगा: "Methionine\nPhenylalanine\nSerine\n"
अगर इनपुट अमान्य हो, तो खाली स्ट्रिंग आउटपुट कीजिए।
Exercism पर साइन अप कीजिए और WebAssembly को 87 अभ्यास तथा असली इंसानों से मिलने वाली मेंटरिंग के साथ सीखिए और उसमें महारत हासिल कीजिए, वह भी बिल्कुल मुफ्त।
इस अभ्यास को हल करने के 11 अलग-अलग तरीके जानिए। इनमें इम्परेटिव तरीके, पैटर्न मैचिंग, रिकर्शन और हायर ऑर्डर फंक्शन जैसे फंक्शनल विचार, और C++ तथा Assembly में की गई कुछ लो-लेवल कोडिंग शामिल हैं।