Speed sweep

pg-019f2c34-e69e-768e-b660-3752b0944177-sweep

pg-019f2c34-e69e-768e-b660-3752b0944177-sweep

Record

Recipe
pg-mlx-community-nvidia-nemotron-3-nano-30b-a3b-mlx-8bit-8bit-apple-m5-pro-64gb-mlx-46f27ba7f1
Measured
2026-07-04T08:18:12.251Z
Points
4

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
18,25659.6observed
132,83254.6observed
1258,11130.2observed
132,76821,404.4observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
pg-019f2c34-e69e-768e-b660-3752b0944177-sweep
measured at
2026-07-04T08:18:12.251Z
recipe id
pg-mlx-community-nvidia-nemotron-3-nano-30b-a3b-mlx-8bit-8bit-apple-m5-pro-64gb-mlx-46f27ba7f1
schema version
local-ai-registry/v1

metrics

base memory bytes
34023717904
base memory context tokens
192
concurrency
1
decode32k context tokens
32,832
decode32k tps
54.575
decode8k context tokens
8,256
decode8k tps
59.553
decode max context tokens
258,111
decode max context tps
30.18
decode mode
non-mtp
inference engine version
unknown
latest point at
2026-07-04T08:18:12.251Z
max context tokens
258,111
max prompt tokens
258,047
memory8k bytes
37118863226
memory8k context tokens
8,256
memory max context bytes
40344936326
memory max context tokens
258,111
peak generation tps
54.575
peak memory bytes
40344936326
peak prompt tps
1,530.901
point count
223
ttft32k cached prompt tokens
28,736
ttft32k context tokens
32,768
ttft32k seconds
21.404

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
18,25659.55359.553Unknown34.57Unknown1
132,83254.57554.575Unknown37.574Unknown1
1258,11130.1830.18Unknown37.574Unknown1
132,768UnknownUnknownUnknownUnknownUnknown1
Provenance & metadata (1)

source

paths
publication:pg-20260827T060320709Z, run:019f2c34-e69e-768e-b660-3752b0944177
repository
local.ai