طراحی pipelineهای محاسباتی و بازتولیدپذیر برای پردازش و تحلیل دادههای زیستی.
Pipelineها میتوانند پیشپردازش، کنترل کیفیت، ابزارهای تحلیلی، مدلهای یادگیری ماشین، پایگاه داده، مدیریت workflow و گزارشدهی را ترکیب کنند.
این pipelineها برای workflowهای ژنومی، transcriptomics، پروتئین، بومشناسی و سایر مسائل زیستشناسی محاسباتی کاربرد دارند.
روش پیادهسازی بر اساس دادههای موجود، محدودیتهای فنی، میزان اتوماسیون مورد نیاز و زیرساخت نرمافزاری یا پژوهشی پروژه انتخاب میشود. راهکار میتواند بهصورت یک جزء مستقل یا درون یک سامانه بزرگتر پیادهسازی شود.
هدف، ایجاد یک جریان محاسباتی روشن و قابل ارزیابی است که بتوان آن را در ادامه نگهداری، توسعه و با نیازهای جدید پروژه تطبیق داد. بنابراین انتخاب مدل، پردازش داده، رابطها و روش استقرار بر اساس مسئله واقعی پروژه تعیین میشود.