Speed sweep

nvidia-nemotron-nano-12b-v2-base-q4-k-m-rtx-3060-12gb-llama-cpp-tp2-aoz6b4pv-sweep

nvidia-nemotron-nano-12b-v2-base-q4-k-m-rtx-3060-12gb-llama-cpp-tp2-aoz6b4pv-sweep

Record

Recipe
nvidia-nemotron-nano-12b-v2-base-q4-k-m-rtx-3060-12gb-llama-cpp-tp2-aoz6b4pv
Measured
2026-07-12T07:57:33.788Z
Points
1

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
15121,016.140.4693.3observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
nvidia-nemotron-nano-12b-v2-base-q4-k-m-rtx-3060-12gb-llama-cpp-tp2-aoz6b4pv-sweep
measured at
2026-07-12T07:57:33.788Z
recipe id
nvidia-nemotron-nano-12b-v2-base-q4-k-m-rtx-3060-12gb-llama-cpp-tp2-aoz6b4pv
schema version
local-ai-registry/v1

metrics

concurrency
1
latest point at
2026-07-12T07:57:33.788Z
max context tokens
512
peak generation tps
40.37
peak prompt tps
1,016.05
point count
1

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
151240.37Unknown1289.91,016.051
Provenance & metadata (1)