songsee

Generate spectrograms and multi-panel feature visualizations from audio files.

Updated Apr 24, 2026
One-click install
npx skills add https://github.com/frankhli843/gemmahermes --skill songsee-frankhli843
Or copy as Structured Prompt for Agent
Please help me install this Agent Skill.
Skill: songsee
Source: https://github.com/frankhli843/gemmahermes/tree/main/skills/songsee
Command: npx skills add https://github.com/frankhli843/gemmahermes --skill songsee-frankhli843

SYSTEM DOCUMENTATION & REQUIREMENTS

What problem does it solve?

Songsee provides a simple CLI to generate spectrograms and multi-panel feature visualizations from audio, enabling quick visual analysis and documentation of audio content.

Core Features & Use Cases

  • Generate spectrograms from audio files for quick inspection.
  • Create multi-panel feature visualizations (e.g., mel spectrogram, chroma, MFCCs) for research, music analysis, and quality control.
  • Automate visualization output as image files for reports and dashboards.

Quick Start

Run songsee on an audio file to generate a spectrogram and a configurable feature-panel visualization.

Frequently Asked Questions about songsee

High-intent search queries and answers about installing and using this skill.

FAQPage Schema
How do I generate a spectrogram from an audio file for quick visual inspection?

To generate a spectrogram from an audio file, use a CLI tool that processes standard audio input formats and outputs a PNG image file for immediate visual analysis. This enables quick inspection of audio content without manual plotting.

Can I create multi-panel feature visualizations like MFCCs and chroma for music analysis?

Yes, you can create multi-panel feature visualizations including mel spectrograms, chroma, and MFCCs for music analysis. The CLI generates these feature views as image files, supporting research, production quality control, and audio debugging tasks.

What audio input formats are supported for generating feature-panel visualizations?

The tool supports standard audio input formats for generating feature-panel visualizations. It processes these inputs via the CLI and outputs PNG or related image files while exposing options for visualization styles and windowing parameters.

How do I automate audio visualization output as image files for reports?

You can automate audio visualization output by running the CLI to generate spectrograms and feature panels as PNG image files. This allows you to integrate visualization generation directly into automated pipelines for reports and dashboards.

Does the CLI offer options for spectrogram visualization styles and windowing?

Yes, the CLI exposes options for visualization styles and windowing when generating spectrograms. These configurable parameters allow you to tailor the audio feature extraction and visual output to suit specific research or debugging needs.

What is the best way to visualize audio features for debugging and quality control?

The best way to visualize audio features for debugging and quality control is using a CLI that generates multi-panel feature views like spectrograms and MFCCs. This provides a comprehensive visual breakdown of audio characteristics for thorough analysis.