quantization-and-model-compression
Quantize LLMs to INT4 precision and apply speculative decoding with draft models.
npx skills add https://github.com/jpoindexter/design-and-ai-skills --skill quantization-and-model-compression
Or copy as Structured Prompt for Agent▼
Please help me install this Agent Skill. Skill: quantization-and-model-compression Source: https://github.com/jpoindexter/design-and-ai-skills/tree/main/ai-engineering-skills/quantization-and-model-compression Command: npx skills add https://github.com/jpoindexter/design-and-ai-skills --skill quantization-and-model-compression