Speed sweep

nvidia-nemotron-nano-12b-v2-base-iq4-xs-rtx-3060-ti-8gb-llama-cpp-tp1-sweep

nvidia-nemotron-nano-12b-v2-base-iq4-xs-rtx-3060-ti-8gb-llama-cpp-tp1-sweep

Record

Recipe
nvidia-nemotron-nano-12b-v2-base-iq4-xs-rtx-3060-ti-8gb-llama-cpp-tp1
Measured
2026-07-02T20:07:42.429Z
Points
1

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
12,0481,755.964.3291.6observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
nvidia-nemotron-nano-12b-v2-base-iq4-xs-rtx-3060-ti-8gb-llama-cpp-tp1-sweep
measured at
2026-07-02T20:07:42.429Z
recipe id
nvidia-nemotron-nano-12b-v2-base-iq4-xs-rtx-3060-ti-8gb-llama-cpp-tp1
schema version
local-ai-registry/v1

metrics

concurrency
1
latest point at
2026-07-02T20:07:42.429Z
max context tokens
2,048
peak generation tps
64.25
peak prompt tps
1,755.89
point count
1

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
12,04864.25Unknown128Unknown1,755.891
Provenance & metadata (1)