What problem does it solve?
scikit-bio provides a comprehensive foundation for biological data analysis by offering sequence manipulation, alignment, phylogenetic analysis, and diversity metrics in Python.
Core Features & Use Cases
- Sequence Manipulation: manipulate DNA/RNA/protein sequences, including reading/writing formats like FASTA/FASTQ and performing reverse-complement, transcription, translation, and motif finding.
- Phylogenetic Analysis: construct and analyze phylogenetic trees, distance matrices, and tree-based diversity metrics.
- Diversity & Ordination: compute alpha/beta diversity metrics and run ordination methods (PCoA, CCA, RDA) for community data.
- Format Interoperability: read and write 19+ formats including BIOM, Newick, and various sequence formats with automatic detection.
- Use Case: Build a microbiome workflow that reads a BIOM table, computes alpha and beta diversity, and visualizes ordination results.
Quick Start
Load a small example sequence, compute its reverse-complement, and run a basic PCoA on a simple distance matrix.