gguf-quantization
Convert llama.cpp models to GGUF format with 2-8 bit quantization.
npx skills add https://github.com/valentinuuiuiu/vikarma --skill gguf-quantization-valentinuuiuiu
Or copy as Structured Prompt for Agent▼
Please help me install this Agent Skill. Skill: gguf-quantization Source: https://github.com/valentinuuiuiu/vikarma/tree/main/hermes_agent/skills/mlops/inference/gguf Command: npx skills add https://github.com/valentinuuiuiu/vikarma --skill gguf-quantization-valentinuuiuiu