Speed sweep

glm-4-9b-chat-q4-0-rocmfp4-fast-radeon-ai-pro-r9700-32gb-llama-cpp-tp3-sweep

glm-4-9b-chat-q4-0-rocmfp4-fast-radeon-ai-pro-r9700-32gb-llama-cpp-tp3-sweep

Record

Recipe
glm-4-9b-chat-q4-0-rocmfp4-fast-radeon-ai-pro-r9700-32gb-llama-cpp-tp3
Measured
2026-08-04T22:40:31.249Z
Points
1

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
17832,952.365.7178.5observed

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
glm-4-9b-chat-q4-0-rocmfp4-fast-radeon-ai-pro-r9700-32gb-llama-cpp-tp3-sweep
measured at
2026-08-04T22:40:31.249Z
recipe id
glm-4-9b-chat-q4-0-rocmfp4-fast-radeon-ai-pro-r9700-32gb-llama-cpp-tp3
schema version
local-ai-registry/v1

metrics

concurrency
1
inference engine version
ROCmFPX-117
latest point at
2026-08-04T22:40:31.249Z
max context tokens
783
peak generation tps
65.748
peak prompt tps
2,952.29
point count
1

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
178365.74865.7482569.142,952.291
Provenance & metadata (1)