Performance skills
Free performance skills for AI coding agents, part of our developer tools collection.
134 skills
Hierarchical Context Parallel
nvidia
Optimize Megatron-Bridge for hierarchical context parallelism.
Jetson Print Device Info
nvidia
Capture essential Jetson device details effortlessly.
MoE VLM Training
nvidia
Optimize your MoE VLM training with practical guidance.
MoE Communication Overlap
nvidia
Optimize expert-parallel communication in Megatron Bridge.
MoE Long-Context Training
nvidia
Optimized guidance for long-context MoE training.
Metrics Analysis
google-gemini
Enhance repository health through data-driven insights.
TensorBoard
davila7
Visualize and debug machine learning models effectively.
Model Pruning
davila7
Compress LLMs and speed up inference with pruning techniques.
GPTQ Quantization
davila7
Efficiently deploy large LLMs on consumer GPUs with minimal loss.
Half-Quadratic Quantization
davila7
Efficient model quantization without calibration data.
GGUF Quantization
davila7
Efficient model deployment for consumer hardware.
Flash Attention Optimization
davila7
Enhance transformer performance with optimized attention.
BitsAndBytes Quantization
davila7
Optimize LLMs with efficient quantization techniques.
AWQ Quantization
davila7
Optimize large models with 4-bit quantization.
Spark Engineer
jeffallan
Optimize and debug your Spark applications effectively.
Debug Optimize LCP
chromedevtools
Optimize Largest Contentful Paint for faster page loads.
Qdrant Memory Optimization
github
Diagnose and reduce Qdrant memory usage effectively.
Qdrant Search Optimization
github
Diagnose and fix slow Qdrant search performance.
Qdrant Performance Optimization
github
Enhance the efficiency of your Qdrant deployment.
Next.js & React Performance Expert
vudovn
Optimize your React and Next.js applications effectively.
Content Hash File Cache Pattern
affaan-m
Efficiently cache file processing results using content hashes.
Flash Attention
nousresearch
Accelerate transformer training and inference significantly.
HuggingFace Accelerate
nousresearch
Simplify distributed PyTorch training with minimal code changes.
V3 MCP Optimization
ruvnet
Enhance your MCP server for faster performance.
