{"data":{"capabilities":{"chat":true,"reasoning":false,"tools":false,"vision":false},"description":"Release-blocked Gemma-4-12B-it EXL3 3 bpw candidate on one RTX 2000 Ada. Exact 128K C1/C2/C4, deterministic correctness, and CUDA graphs passed in a pinned base image with the pinned TabbyAPI stack installed, but the declared release image still needs an exact replay.","engine":{"graph_mode":"piecewise","name":"tabbyapi","version":"0.0.1+e632af41"},"facts":{"metadata":{"provenance":{"captured_at":"2026-08-27T06:04:13.773Z","sources":[{"captured_at":"2026-08-27T06:04:13.773Z","kind":"registry-enrichment","url":"https://github.com/0xSero/local-ai-registry"}]},"reason":"not-observed","state":"unknown"}},"hardware_count":1,"hardware_id":"rtx-2000-ada-16gb","id":"gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1","launch":{"accelerator_backend":"nvidia","arguments":["main.py","--config","/app/config.yml"],"container":{"captured_at":"2026-08-27T06:04:13.773Z","compose_file":null,"digest":"sha256:ffa8388f310d3c8a2727c66d14a76bb663fdb99a2a49e68a43c3bebb5a3e53f1","image":"ghcr.io/theroyallab/tabbyapi:cu13@sha256:ffa8388f310d3c8a2727c66d14a76bb663fdb99a2a49e68a43c3bebb5a3e53f1","reason":"image-reference-in-launch","runtime":"docker","source":[{"captured_at":"2026-08-27T06:04:13.773Z","kind":"recipe-launch","url":"https://github.com/0xSero/local-ai-registry"}],"state":"digest-pinned"},"container_port":5000,"entrypoint":"/opt/venv/bin/python3","environment":{"NVIDIA_VISIBLE_DEVICES":"all"},"host_port":5000,"image":"ghcr.io/theroyallab/tabbyapi:cu13@sha256:ffa8388f310d3c8a2727c66d14a76bb663fdb99a2a49e68a43c3bebb5a3e53f1","ipc":"host","kind":"docker","mounts":[{"read_only":true,"source":"~/.cache/inference-index/models/gemma-4-12b-it-exl3-3bpw","target":"/workspace/models"}],"network_mode":"host","shm_size":"8g"},"metadata":{"launch_config":{"detail":"The referenced TabbyAPI config for the EXL3 3bpw variant was never captured; the mount has been removed rather than pointing at a nonexistent file.","state":"not-captured"}},"model_instance_id":"turboderp-gemma-4-12b-it-exl3--3-bpw","provenance":{"captured_at":"2026-08-27T06:04:13.773Z","sources":[{"captured_at":"2026-08-27T06:04:13.773Z","kind":"normalized-recipe","url":"https://github.com/0xSero/local-ai-registry"}]},"recipe_source":"0xsero","schema_version":"local-ai-registry/v1","serving":{"kv_cache_tokens":557056,"max_concurrency":4,"max_context_tokens":131072,"tensor_parallel":1},"speed_sweep_ids":["gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1-sweep"],"status":"candidate","huggingface":{"link_type":"repository","provenance":{"captured_at":"2026-08-27T06:04:13.773Z","sources":[{"captured_at":"2026-08-27T06:04:13.773Z","kind":"huggingface-api","url":"https://huggingface.co/api/models/turboderp/gemma-4-12B-it-exl3"}]},"reason":"hf-api-confirmed-public","repository":"turboderp/gemma-4-12B-it-exl3","status":"known","url":"https://huggingface.co/turboderp/gemma-4-12B-it-exl3"},"registry":{"launchable":false,"speed_evidence":{"available":true,"count":1,"speed_sweep_ids":["gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1-sweep"],"detail_urls":["/api/v1/speed-sweep/gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1-sweep"]},"runtime":"docker"},"relationships":{"hardware":{"api":"/api/v1/hardware/rtx-2000-ada-16gb","href":"/hardware/rtx-2000-ada-16gb","id":"rtx-2000-ada-16gb","name":"NVIDIA RTX 2000 Ada Generation"},"model":{"api":"/api/v1/models/gemma-4-12b-it","href":"/models/gemma-4-12b-it","id":"gemma-4-12b-it","name":"Gemma-4-12B-it"},"model_instance":{"api":"/api/v1/model-instances/turboderp-gemma-4-12b-it-exl3--3-bpw","href":"/model-instances/turboderp-gemma-4-12b-it-exl3--3-bpw","id":"turboderp-gemma-4-12b-it-exl3--3-bpw","name":"turboderp/gemma-4-12B-it-exl3"},"speed_sweep":[{"api":"/api/v1/speed-sweep/gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1-sweep","href":"/speed-sweep/gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1-sweep","id":"gemma-4-12b-it-exl3-3bpw-rtx2000ada-tabbyapi-tp1-sweep"}]}},"meta":{"source":"registry"}}