Open-source CLI that auto-tunes and benchmarks llama.cpp / ik_llama.cpp inference on NVIDIA GPUs. Find the fastest config in seconds.
Install Dyno and tune your first model in under a minute.
pipx install llama-dyno
dyno detect
Fingerprints your GPU, VRAM, driver version, CPU, RAM, and detects which llama.cpp backend is installed.
dyno tune ~/models/mistral-7b.Q4_K_M.gguf --quick
Finds the fastest config โ ngl, flash attention, KV cache quant, batch size, threads โ with live progress.
dyno bench ~/models/mistral-7b.Q4_K_M.gguf --ngl 99 --fa
dyno report ~/models/mistral-7b.Q4_K_M.gguf
Every command Dyno offers.
dyno detect
dyno tune <model>
dyno bench <model>
dyno report <model>
dyno submit <model>
dyno search [gpu] [model]
dyno compare [gpu] [model]
Dyno's Rich-powered terminal output.
โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโ โ System Detection โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโค โ Component Value โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโค โ GPU NVIDIA GeForce RTX 4090 โ โ VRAM 24564 MiB โ โ Driver 545.23.08 โ โ CUDA 12.3 โ โ CPU AMD Ryzen 9 7950X โ โ Cores 16 โ โ RAM 64228 MiB โ โ Backend llama.cpp โ โ Commit b1c2d3e โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโ
โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโ โ Benchmark Results โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโค โ Metric Median Var โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโค โ PP (prompt processing) 520.3 1.2 โ โ TG (text generation) 58.7 0.4 โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโ โ Generation: 58.7 tok/s | Prompt: 520.3 tok/s
โญโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโฎ โ ๐ Best Config โ โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโค โ ngl=99, fa=โ, ctk=f16, ctv=f16 โ โ batch=1024, ubatch=512, threads=0 โ โฐโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโฏ