Key points are not available for this paper at this time.
संक्षिप्त विवरण जेनेट सेट विश्लेषण (GSA), उच्च-थ्रूपुट जीन अभिव्यक्ति डेटा का विश्लेषण करने के लिए एक लोकप्रिय दृष्टिकोण, संबंधित जीन के सेटों की पहचान करना है जो विभिन्न परिस्थितियों के बीच महत्वपूर्ण रूप से समृद्ध या घटित अभिव्यक्ति पैटर्न दिखाते हैं। पिछले वर्षों में, इस कार्य के लिए कई विधियाँ विकसित की गई हैं। हालाँकि, स्पष्ट मार्गदर्शन की कमी है: सही विधि का चयन करना एक शोधकर्ता का पहला बाधा है। इस तथाकथित विधि अनिश्चितता को पार करने के लिए चुनौतियाँ उतनी ही कठिन हैं जितनी डेटा प्रोसेसिंग की प्रक्रियाएँ, जिसमें यह जानना शामिल है कि कौन से चरण आवश्यक हैं और वैध विकल्पों की विविधता में से एक उपयुक्त दृष्टिकोण का चयन करना (डेटा प्रोसेसिंग की अनिश्चितता), जिसमें फिर से स्पष्ट मार्गदर्शन की कमी है। यहाँ, हम GSA को करने के लिए आवश्यक सभी चरणों के माध्यम से एक व्यावहारिक मार्गदर्शिका प्रदान करते हैं, जिसमें स्थापित विधियों का संक्षिप्त अवलोकन शामिल है, जिसमें जीन सेट समृद्धि विश्लेषण और एनोटेशन, दृश्याकरण, और समाहित खोज के लिए डेटा बेस (DAVID) शामिल हैं। हम प्रत्येक विचार किए गए विधि के लिए आवश्यक पूर्व प्रोसेसिंग चरणों की समीक्षा और व्याख्या पर विशेष ध्यान केंद्रित करते हैं (जैसे RNA अनुक्रमण डेटा का परिवर्तित करना)—यह एक आवश्यक पहलू है जिसे सामान्यतः मौजूदा समीक्षाओं और अनुप्रयोगों में सीमित ध्यान दिया जाता है। अनिश्चितताओं के स्पेक्ट्रम के प्रति जागरूकता बढ़ाने के लिए, हमारी समीक्षा हर चरण के लिए वैध दृष्टिकोणों पर साहित्य का एक विस्तृत अवलोकन और जटिल विश्लेषण पाइपलाइनों को प्रदर्शित करने वाले R कोड के उदाहरण के साथ आती है। यह परिणामों पर चर्चा और दोनों उपयोगकर्ताओं और विकासकर्ताओं को सिफारिशों के साथ समाप्त होता है ताकि यह सुनिश्चित किया जा सके कि GSA के परिणाम, ऊपर उल्लिखित अनिश्चितताओं के बावजूद, पुनरुत्पादनीय और पारदर्शी हैं। यह लेख केटेगरी में है: सांख्यिकीय और ग्राफिकल डेटा विश्लेषण की विधियाँ > उच्च आयामी डेटा का विश्लेषण जानकारी: प्रकार और संरचना > डेटा तैयारी और प्रोसेसिंग गणितीय सांख्यिकी के अनुप्रयोग > जीनोमिक्स/प्रोटीओमिक्स/ज genetics
वुंड्श और सहयोगियों (Mon,) ने इस प्रश्न का अध्ययन किया।