GGUF · Llama 24B mradermacher quant pack ctx 32k license: WTFPL

BlackXorDolphTronGOAT

Interactive demo hub for mradermacher/BlackXorDolphTronGOAT-GGUF — static GGUF quants of a 24B Llama merge. Pick a quant, generate ready-to-run commands for llama.cpp / Python / LM Studio, and preview the chat template prompt.

// Choose quant

File size
—
Rough RAM / VRAM
—
Recommendation
—
QuantSizeNotes
Hosting note: Free Hugging Face accounts can host Static Spaces only. Live on-Space GGUF inference (Gradio + llama.cpp) needs a PRO plan or paid hardware. This page gives you a one-click download path and local run commands.

// Run locally


        
4096
40

// Chat template playground

This GGUF ships a Mistral-style template ([SYSTEM_PROMPT]…[/SYSTEM_PROMPT], [INST]…[/INST]). Build a prompt offline — generation still happens in your local runner.

Rendered prompt
Click “Build prompt” to preview.