Speed sweep

nvidia-nemotron-nano-9b-v2-q4-k-m-rtx-3090-24gb-llama-cpp-tp1-sweep

nvidia-nemotron-nano-9b-v2-q4-k-m-rtx-3090-24gb-llama-cpp-tp1-sweep

Record

Recipe
nvidia-nemotron-nano-9b-v2-q4-k-m-rtx-3090-24gb-llama-cpp-tp1
Measured
2026-07-20T06:33:23.877Z
Points
1

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
15125,608.8171.3159.5observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
nvidia-nemotron-nano-9b-v2-q4-k-m-rtx-3090-24gb-llama-cpp-tp1-sweep
measured at
2026-07-20T06:33:23.877Z
recipe id
nvidia-nemotron-nano-9b-v2-q4-k-m-rtx-3090-24gb-llama-cpp-tp1
schema version
local-ai-registry/v1

metrics

concurrency
1
latest point at
2026-07-20T06:33:23.877Z
max context tokens
512
peak generation tps
171.33
peak prompt tps
5,608.82
point count
1

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
1512171.33Unknown1280.015,608.821
Provenance & metadata (1)