Speed sweep

pg-019f2c34-d3c5-7e1a-9465-09aabab3889a-sweep

pg-019f2c34-d3c5-7e1a-9465-09aabab3889a-sweep

Record

Recipe
pg-mlx-community-nvidia-nemotron-3-nano-30b-a3b-nvfp4-nvfp4-apple-m4-max-36gb-mlx-76eda111c4
Measured
2026-08-09T16:05:24.472Z
Points
4

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
18,25679.2observed
132,83270.9observed
1262,07936.1observed
132,76835,234.9observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
pg-019f2c34-d3c5-7e1a-9465-09aabab3889a-sweep
measured at
2026-08-09T16:05:24.472Z
recipe id
pg-mlx-community-nvidia-nemotron-3-nano-30b-a3b-nvfp4-nvfp4-apple-m4-max-36gb-mlx-76eda111c4
schema version
local-ai-registry/v1

metrics

base memory bytes
19924889836
base memory context tokens
192
concurrency
1
decode32k context tokens
32,832
decode32k tps
70.875
decode8k context tokens
8,256
decode8k tps
79.238
decode max context tokens
262,079
decode max context tps
36.058
decode mode
non-mtp
inference engine version
0.31.3
latest point at
2026-08-09T16:05:24.472Z
max context tokens
262,079
max prompt tokens
262,015
memory8k bytes
22882294906
memory8k context tokens
8,256
memory max context bytes
26131453238
memory max context tokens
262,079
peak generation tps
70.875
peak memory bytes
26131453238
peak prompt tps
929.987
point count
224
ttft32k cached prompt tokens
28,736
ttft32k context tokens
32,768
ttft32k seconds
35.235

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
18,25679.23879.238Unknown21.311Unknown1
132,83270.87570.875Unknown24.337Unknown1
1262,07936.05836.058Unknown24.337Unknown1
132,768UnknownUnknownUnknownUnknownUnknown1
Provenance & metadata (1)

source

paths
publication:pg-20260827T060320709Z, run:019f2c34-d3c5-7e1a-9465-09aabab3889a
repository
local.ai