Stack Gems
Menu
← Skills

Hugging Face Local Models

GGUF + llama.cpp on CPU/Metal/CUDA/ROCm

Hugging Face · Apache-2.0

When

Use to select models to run locally with llama.cpp and GGUF on CPU, Mac Metal, CUDA, or ROCm. Covers finding GGUFs, quant selection, running servers, exact GGUF file lookup, conversion, and OpenAI-compatible local serving.

The Catch

GGUF + llama.cpp on CPU/Metal/CUDA/ROCm. Not a cloud-Jobs trainer.

Embed

Reviewed on Stack Gems
[![Reviewed on Stack Gems](https://stackgems.com/badge/skill/huggingface-local-models.svg)](https://stackgems.com/skills/huggingface-local-models)