{"data":{"capabilities":{"chat":null,"reasoning":null,"tools":null,"vision":null},"description":"Observed LocalMaxxing leaderboard run. Evidence for compatibility, not an executable launch contract.","engine":{"graph_mode":null,"name":"llama.cpp","version":"b8833 (45cac7ca7)"},"facts":{"capabilities.chat":{"provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"capability-not-verified","state":"unknown"},"capabilities.reasoning":{"provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"capability-not-verified","state":"unknown"},"capabilities.tools":{"provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"capability-not-verified","state":"unknown"},"capabilities.vision":{"provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"capability-not-verified","state":"unknown"},"engine.graph_mode":{"provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"runtime-detail-not-published","state":"unknown"},"serving.kv_cache_tokens":{"provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"kv-cache-capacity-not-published","state":"unknown"},"serving.max_concurrency":{"provenance":{"captured_at":"2026-08-31T23:03:15Z","sources":[{"captured_at":"2026-08-31T23:03:15Z","kind":"registry-derived","url":"https://www.localmaxxing.com/en/runs/cmon7v1f70007l204wtsw8ogj"}]},"reason":"server-capacity-derived-from-source-evidence","state":"known"}},"hardware_count":1,"hardware_id":"dgx-spark-gb10-128gb","id":"minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj","launch":{"container":{"captured_at":"2026-08-30T09:26:09Z","compose_file":null,"digest":null,"image":null,"reason":"reference-only-launch","runtime":null,"source":[{"captured_at":"2026-08-30T09:26:09Z","kind":"recipe-launch","url":"https://www.localmaxxing.com/en/runs/cmon7v1f70007l204wtsw8ogj"}],"state":"none"},"kind":"reference","run_id":"cmon7v1f70007l204wtsw8ogj","source":"localmaxxing","url":"https://www.localmaxxing.com/en/runs/cmon7v1f70007l204wtsw8ogj"},"metadata":{"localmaxxing":{"backend":"cuda","batch_size":1,"hardware_label":"GB10 Grace Blackwell","notes":"Companion submission to cmomfmks00003k204617egw2l (unsloth/MiniMax-M2.7 GGUF). Same measurement, posted against root model MiniMaxAI/MiniMax-M2.7 with quantization=UD-IQ4_XS explicit so it surfaces on the canonical model page.\n\nMiniMax-M2.7-UD-IQ4_XS (101 GB GGUF) on a single DGX Spark with llama.cpp ngram-simple speculative decode at 108K context. Sherlock prose, pp=128, tg=128, c=1, depth=0. tokSOut = 30.88 t/s MEDIAN over n=38 warm trials across 2 independent rounds (mean 30.88, std 4.11, range 24.57-41.85). ttftMs = 807 median. Same headline tg/s at 3.3× context window vs my prior 32K submission, with provably stable long-context behavior (5-phase battery + 10× back-to-back 100K torture, R10/R1=1.006).\n\nImage base PINNED to nvcr.io/nvidia/cuda:13.0.0-devel-ubuntu24.04 — CUDA 13.2/13.3 bases produced silent libcublas matmul corruption on GB10 sm_121. Pre-flight: `readlink libcublas.so.13` must show 13.0.0.19. Stability flags overriding defaults: --cache-reuse 256, --ctx-checkpoints 0, -cram 100 (NOT 4096; 4096 collapses decode 5.6→1.0 t/s by run 4). Spec acceptance ~36-82% across runs.\n\nRecipe + raw JSONs + Dockerfile: github.com/my-other-github-account/spark-bench-reproducers/tree/main/minimax-m27-longctx-108k-spark\n\nBy @banana_baeee.","observed_command":"/opt/llama.cpp/build-cuda/bin/llama-server --jinja -fa on --no-warmup -t 20 -c 108000 -ctk q8_0 -ctv q8_0 -np 1 -ngl 99 -a MiniMax-M2.7-UD-IQ4_XS -m /models/MiniMax-M2.7-GGUF/UD-IQ4_XS/MiniMax-M2.7-UD-IQ4_XS-00001-of-00004.gguf --host 0.0.0.0 --port 18080 --cache-reuse 256 --ctx-checkpoints 0 -cram 100 --spec-type ngram-simple --draft-max 16 --draft-min 1 --draft-p-min 0.5 --spec-ngram-size-n 4","run_id":"cmon7v1f70007l204wtsw8ogj","tokenized":{"arguments":["/opt/llama.cpp/build-cuda/bin/llama-server","--jinja","-fa","on","--no-warmup","-t","20","-c","108000","-ctk","q8_0","-ctv","q8_0","-np","1","-ngl","99","-a","MiniMax-M2.7-UD-IQ4_XS","-m","/models/MiniMax-M2.7-GGUF/UD-IQ4_XS/MiniMax-M2.7-UD-IQ4_XS-00001-of-00004.gguf","--host","0.0.0.0","--port","18080","--cache-reuse","256","--ctx-checkpoints","0","-cram","100","--spec-type","ngram-simple","--draft-max","16","--draft-min","1","--draft-p-min","0.5","--spec-ngram-size-n","4"],"fidelity":"faithful"}}},"model_instance_id":"minimaxai-minimax-m2-7--ud-iq4-xs","provenance":{"captured_at":"2026-08-30T09:26:09Z","sources":[{"captured_at":"2026-08-30T09:26:09Z","kind":"normalized-recipe","url":"https://www.localmaxxing.com/en/runs/cmon7v1f70007l204wtsw8ogj"}]},"recipe_source":"localmaxxing","schema_version":"local-ai-registry/v1","serving":{"kv_cache_tokens":null,"max_concurrency":1,"max_context_tokens":108000,"tensor_parallel":1},"speed_sweep_ids":["minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj-sweep"],"status":"candidate","huggingface":{"link_type":"repository","provenance":{"captured_at":"2026-08-30T09:10:02Z","sources":[{"captured_at":"2026-08-30T09:10:02Z","kind":"huggingface-api","url":"https://huggingface.co/api/models/MiniMaxAI/MiniMax-M2.7"}]},"reason":"hf-api-confirmed-public","repository":"MiniMaxAI/MiniMax-M2.7","status":"known","url":"https://huggingface.co/MiniMaxAI/MiniMax-M2.7"},"registry":{"launchable":false,"speed_evidence":{"available":true,"count":1,"speed_sweep_ids":["minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj-sweep"],"detail_urls":["/api/v1/speed-sweep/minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj-sweep"]},"runtime":"reference"},"relationships":{"hardware":{"api":"/api/v1/hardware/dgx-spark-gb10-128gb","href":"/hardware/dgx-spark-gb10-128gb","id":"dgx-spark-gb10-128gb","name":"NVIDIA DGX Spark GB10"},"model":{"api":"/api/v1/models/minimax-m2-7","href":"/models/minimax-m2-7","id":"minimax-m2-7","name":"MiniMax-M2.7"},"model_instance":{"api":"/api/v1/model-instances/minimaxai-minimax-m2-7--ud-iq4-xs","href":"/model-instances/minimaxai-minimax-m2-7--ud-iq4-xs","id":"minimaxai-minimax-m2-7--ud-iq4-xs","name":"MiniMaxAI/MiniMax-M2.7"},"speed_sweep":[{"api":"/api/v1/speed-sweep/minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj-sweep","href":"/speed-sweep/minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj-sweep","id":"minimax-m2-7-ud-iq4-xs-dgx-spark-gb10-128gb-llama-cpp-tp1-wtsw8ogj-sweep"}]}},"meta":{"source":"registry"}}