What problem does it solve?
scikit-bio helps you turn biological sequence and community ecology data into analysis-ready objects for alignment, phylogenetics, diversity metrics, ordination, and permutation-based statistics.
Core Features & Use Cases
- Sequence I/O and manipulation: Load and transform biological sequences using FASTA/FASTQ/GenBank/Newick and other supported formats, including reverse-complement, transcription, translation, motif/regex matching, and metadata handling.
- Alignments and phylogenetic workflows: Run pairwise and multiple sequence alignments, build phylogenetic trees from distance matrices, and compute tree distances and comparisons.
- Microbiome/community statistics: Compute alpha and beta diversity (including UniFrac), perform ordination (PCoA/CCA/RDA), and run group-difference tests like PERMANOVA with permutation control.
- File formats and distance/ordination integration: Use consistent distance/dissimilarity matrices and rich ordination result objects for downstream visualization and interpretation.
Quick Start
Use the scikit-bio skill to compute PCoA from a microbiome beta-diversity distance matrix stored as a delimited text file.