tensorrt-llm
Optimize LLM inference on NVIDIA GPUs with TensorRT-LLM quantization and batching.
npx skills add https://github.com/davpatel605-beep/hermusagent --skill tensorrt-llm-davpatel605-beep
Or copy as Structured Prompt for Agent▼
Please help me install this Agent Skill. Skill: tensorrt-llm Source: https://github.com/davpatel605-beep/hermusagent/tree/main/backend/vendor/hermes/optional-skills/mlops/tensorrt-llm Command: npx skills add https://github.com/davpatel605-beep/hermusagent --skill tensorrt-llm-davpatel605-beep