{"data":{"accepted_at":null,"id":"nemotron-cascade-14b-thinking-q4-k-m-rtx-3060-12gb-llama-cpp-tp2-sweep","measured_at":"2026-07-12T08:59:41.177Z","metrics":{"concurrency":1,"inference_engine_version":"13f2b28","latest_point_at":"2026-07-12T08:59:41.177Z","max_context_tokens":512,"peak_generation_tps":35.73,"peak_prompt_tps":1139.95,"point_count":1},"recipe_id":"nemotron-cascade-14b-thinking-q4-k-m-rtx-3060-12gb-llama-cpp-tp2","rows":[{"concurrency":1,"context_tokens":512,"decode_tok_s":35.73,"decode_tok_s_per_stream":35.73,"output_tokens":128,"peak_vram_gb":15.4,"prefill_tok_s":1139.95,"samples":1,"status":"observed","ttft_ms_p50":486.5}],"schema_version":"local-ai-registry/v1","source":{"commit":null,"kind":"leaderboard","paths":["/en/runs/cmrhkbdh400tamj01duszronu"],"repository":"https://www.localmaxxing.com","url":"https://www.localmaxxing.com/en/runs/cmrhkbdh400tamj01duszronu"},"relationships":{"recipe":{"api":"/api/v1/recipes/nemotron-cascade-14b-thinking-q4-k-m-rtx-3060-12gb-llama-cpp-tp2","href":"/recipes/nemotron-cascade-14b-thinking-q4-k-m-rtx-3060-12gb-llama-cpp-tp2","id":"nemotron-cascade-14b-thinking-q4-k-m-rtx-3060-12gb-llama-cpp-tp2"}}},"meta":{"source":"registry"}}