Speed sweep

qwen3-6-27b-fp8-compressed-tensors-intel-arc-pro-b70-32gb-vllm-tp4-sweep

qwen3-6-27b-fp8-compressed-tensors-intel-arc-pro-b70-32gb-vllm-tp4-sweep

Record

Recipe
qwen3-6-27b-fp8-compressed-tensors-intel-arc-pro-b70-32gb-vllm-tp4
Measured
2026-05-04
Points
1

Measured speed

ConcurrencyContextPrefillDecodeTTFT msStatus
1,02428historical

Remaining fields

Identity, launch, related records, and measured speed are shown above. This is the rest of the normalized record.

id
qwen3-6-27b-fp8-compressed-tensors-intel-arc-pro-b70-32gb-vllm-tp4-sweep
measured at
2026-05-04
recipe id
qwen3-6-27b-fp8-compressed-tensors-intel-arc-pro-b70-32gb-vllm-tp4
schema version
local-ai-registry/v1

metrics

inference engine version
0.20.1
latest point at
2026-05-04
max context tokens
1,024
peak generation tps
28.036
point count
1

rows

concurrencycontext tokensdecode tok sdecode tok s per streamoutput tokenspeak vram gbprefill tok ssamples
Unknown1,02428.036Unknown256UnknownUnknown1
Provenance & metadata (1)