Speed sweep

glm-4-7-flash-q2-k-xl-radeon-ai-pro-r9700-32gb-llama-cpp-tp1-sweep

glm-4-7-flash-q2-k-xl-radeon-ai-pro-r9700-32gb-llama-cpp-tp1-sweep

Record

Recipe
glm-4-7-flash-q2-k-xl-radeon-ai-pro-r9700-32gb-llama-cpp-tp1
Measured
2026-08-19T18:50:59.077Z
Points
1

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
12,0482,046.482.1250.2observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
glm-4-7-flash-q2-k-xl-radeon-ai-pro-r9700-32gb-llama-cpp-tp1-sweep
measured at
2026-08-19T18:50:59.077Z
recipe id
glm-4-7-flash-q2-k-xl-radeon-ai-pro-r9700-32gb-llama-cpp-tp1
schema version
local-ai-registry/v1

metrics

concurrency
1
latest point at
2026-08-19T18:50:59.077Z
max context tokens
2,048
peak generation tps
82.05
peak prompt tps
2,046.41
point count
1

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
12,04882.05Unknown128Unknown2,046.411
Provenance & metadata (1)