تحلیل محاسباتی دادههای بیان ژن و transcriptomics با استفاده از یادگیری ماشین و روشهای آماری.
پروژهها میتوانند پیشپردازش، normalization، کاهش ابعاد، clustering، classification، تحلیل biomarker و مدلسازی پیشبینی را شامل شوند.
این روشها میتوانند از کشف زیستی، شناسایی نمونهها، تحلیل الگوهای بیان و جریانهای پژوهشی محاسباتی پشتیبانی کنند.
روش پیادهسازی بر اساس دادههای موجود، محدودیتهای فنی، میزان اتوماسیون مورد نیاز و زیرساخت نرمافزاری یا پژوهشی پروژه انتخاب میشود. راهکار میتواند بهصورت یک جزء مستقل یا درون یک سامانه بزرگتر پیادهسازی شود.
هدف، ایجاد یک جریان محاسباتی روشن و قابل ارزیابی است که بتوان آن را در ادامه نگهداری، توسعه و با نیازهای جدید پروژه تطبیق داد. بنابراین انتخاب مدل، پردازش داده، رابطها و روش استقرار بر اساس مسئله واقعی پروژه تعیین میشود.