llm-evaluation
Evaluate LLM applications with automated metrics and LLM-as-judge scoring.
npx skills add https://github.com/applied-artificial-intelligence/claude-code-toolkit --skill llm-evaluation-applied-artificial-intelligence
Or copy as Structured Prompt for Agent▼
Please help me install this Agent Skill. Skill: llm-evaluation Source: https://github.com/applied-artificial-intelligence/claude-code-toolkit/tree/main/skills/llm-evaluation Command: npx skills add https://github.com/applied-artificial-intelligence/claude-code-toolkit --skill llm-evaluation-applied-artificial-intelligence