.GGUF

Archivo GGUF

GGML Universal Format File
Hacer una pregunta
RESPUESTA RÁPIDA

Un archivo .gguf es un archivo de formato universal GGML (GGML Universal Format), el contenedor binario utilizado por llama.cpp y herramientas relacionadas para almacenar un modelo de lenguaje grande como un solo archivo. Contiene los pesos del modelo, el tokenizador y todos los metadatos juntos, generalmente cuantizados para que el modelo funcione en hardware convencional. Abra o ejecute un modelo .gguf con una aplicación de inferencia local como LM Studio, Ollama, Jan o GPT4All, o cárguelo directamente con llama.cpp.

Desarrollador: Georgi Gerganov and the ggml/llama.cpp community Categoría: Archivos de datos Estándar abierto MIME: application/octet-stream
SE ABRE EN Windows macOS Linux Web
Relacionado: .PKPASS · .DAT · .JSON · .RIS

En esta página

19k+ extensiones indexadas
Última revisión Sep 4, 2026

¿No está seguro de qué es su archivo?

Suelte cualquier archivo en nuestro identificador - leemos solo los primeros bytes para nombrar el formato.

Identificar un archivo

¿Qué es el formato de archivo GGUF?

Un archivo .gguf es un archivo de formato universal GGML, el contenedor binario utilizado por llama.cpp para almacenar un modelo de lenguaje grande. Georgi Gerganov y la comunidad de ggml lo introdujeron en agosto de 2023 como el sucesor de los formatos más antiguos GGML, GGMF y GGJT. Un solo archivo .gguf contiene los pesos del modelo, el tokenizador y cada hiperparámetro como metadatos de clave-valor tipados, por lo que no se necesitan archivos de configuración separados para cargar y ejecutar el modelo.

El formato está diseñado para ser autónomo, extensible y mapeable en memoria. Debido a que los metadatos se almacenan como pares clave-valor con espacios de nombres en lugar de una lista fija, se pueden agregar nuevos campos sin romper los lectores más antiguos. Los pesos suelen estar cuantizados, desde 2 bits hasta 8 bits e incluyendo K-quants como Q4_K_M, lo que permite que modelos de tamaño considerable se ejecuten en CPU y GPU de consumo. Cada archivo comienza con la cadena mágica de cuatro bytes GGUF, seguida de un número de versión; la versión actual es la 3.

Seguridad y protección

RIESGO: LOW

GGUF is a data container for model weights and metadata, not an executable, so opening one does not run code by itself. The main practical risks are large file sizes and downloading models from untrusted sources; a malformed file could in theory exploit a bug in the loader, so use up-to-date inference tools and reputable model repositories.

Detalles del formato

en pocas palabras
NOMBRE COMPLETOGGML Universal Format Filetambién conocido como GGML Universal File, GGUF model
DESARROLLADORGeorgi Gerganov and the ggml/llama.cpp communitydesde August 2023
TIPO MIMEapplication/octet-stream
TIPOBinary
ESTÁNDARAbierto · libre de regalías
Esta extensión también es utilizada por…
  • Genome Graphical User Format - Rarely, .gguf has been used ad hoc by hobby projects for GUI layout data, unrelated to the machine-learning format described here.
MAGIC BYTES · FIRMA DE ARCHIVO
OFFSET
00010203
HEX
47475546
ASCII
GGUF
First 4 bytes are the ASCII string GGUF (0x47 0x47 0x55 0x46), followed by a 4-byte version, 8-byte tensor count and 8-byte metadata count.

Programas que abren archivos GGUF

Windows6 apps
LM Studio Freemium Browse, download and chat with .gguf models through a desktop GUI, with per-model quantization choices.
Ollama Código abierto Load a local .gguf file via a Modelfile and serve it for chat or API use with one command.
llama.cpp Código abierto Run inference directly on a .gguf model with llama-cli or llama-server, the reference implementation of the format.
Jan Código abierto Import a .gguf file and run it fully offline in a ChatGPT-style desktop app.
GPT4All Código abierto Add a downloaded .gguf model to the local model folder and chat with it offline.
koboldcpp Código abierto Load a .gguf model for text generation and roleplay with a self-contained executable.
macOS4 apps
LM Studio Freemium Download and run .gguf models with Apple Silicon acceleration through a desktop GUI.
Ollama Código abierto Serve a local .gguf model via a Modelfile using Metal acceleration on Apple hardware.
llama.cpp Código abierto Run .gguf models with llama-cli, built with Metal support for Apple Silicon.
Jan Código abierto Import and run .gguf models offline in a native desktop client.
Linux4 apps
llama.cpp Código abierto Build from source and run .gguf models with CUDA, ROCm or CPU backends via llama-cli and llama-server.
Ollama Código abierto Register a local .gguf file with a Modelfile and serve it over the Ollama API.
LM Studio Freemium Run .gguf models with a desktop GUI and GPU offload on supported hardware.
text-generation-webui Código abierto Load .gguf models through the llama.cpp loader in a browser-based interface.
Web1 app
Hugging Face GGUF viewer Gratis Inspect a .gguf file's metadata, tensor list and quantization in the browser without downloading it.

Detalles técnicos

especificación profunda
EncodingBinary
Byte orderLittle-endian by default; big-endian supported since version 3
ContainerSingle-file container holding header, metadata key-value block, tensor info block and raw tensor data
CompressionNone as a container; weights are stored using GGUF quantization schemes (Q2 through Q8, K-quants such as Q4_K_M, IQ variants, plus F16/BF16/F32)
Typical sizeRoughly 0.5 GB to over 100 GB depending on parameter count and quantization level
StructureHeader (magic, version, tensor count, metadata count) then namespaced key-value metadata, then per-tensor info (name, dimensions, type, offset), then aligned raw tensor data. Default alignment is 32 bytes and must be a multiple of 8.
IntegrityNo built-in checksum; the metadata block is self-describing and validated at load time
PlatformsWindows, macOS, Linux
NotesA GGUF file is self-contained: it bundles the model weights, tokenizer and all hyperparameters as typed metadata, so no separate config files are needed. Metadata keys use lower_snake_case with period-separated namespaces and keys can be up to 65,535 bytes. Over 40 quantization types are supported. Large models can be sharded across multiple .gguf files with llama-gguf-split.
LanzadoAugust 2023
Última versiónVersion 3
Estándar abierto · libre de regalías
Especificacióngithub.com

Conversiones de GGUF

Preguntas y respuestas de la comunidad

preguntado por usuarios
Hacer una pregunta rápida
Obtenga ayuda de personas que trabajan con archivos GGUF. Sea específico: incluya su sistema y la versión del software.
No se necesita cuenta · respuestas generalmente en un día

Aún no hay preguntas; sea el primero en preguntar sobre los archivos GGUF.

Preguntas frecuentes

¿Cómo abro un archivo GGUF?
Utilice un ejecutor de LLM local como LM Studio, Ollama, Jan o GPT4All, o cárguelo directamente con llama.cpp. Estas herramientas leen el archivo .gguf y le permiten chatear con el modelo. Hacer doble clic en el archivo no servirá de nada por sí solo.
¿Qué programa crea archivos GGUF?
Son producidos por los scripts de conversión de llama.cpp, principalmente convert_hf_to_gguf.py, que convierte un modelo de Hugging Face en un .gguf, seguido opcionalmente por llama-quantize para reducirlo a una cuantización más pequeña como Q4_K_M.
¿Qué significa el Q4_K_M en un nombre de archivo GGUF?
Es el tipo de cuantización. Q4 significa aproximadamente pesos de 4 bits, K se refiere al método K-quant basado en bloques y M es la variante de tamaño/calidad media (medium). Los números más bajos dan archivos más pequeños y menor calidad; F16 o F32 no están cuantizados.
¿Puedo convertir un archivo GGUF de nuevo al modelo original?
Parcialmente. Puede descuantizarlo a .safetensors o pesos de PyTorch con scripts de la comunidad, pero debido a que la mayoría de los archivos GGUF están cuantizados, la conversión es «lossy» y no restaura los pesos originales exactos.
¿Por qué mi archivo GGUF es tan grande?
Un .gguf contiene cada peso del modelo en un solo archivo. El tamaño del archivo escala con el número de parámetros y el nivel de cuantización, por lo que un modelo grande con una precisión mayor puede superar fácilmente las decenas de gigabytes.
¿Es seguro descargar archivos GGUF?
El formato en sí no contiene código ejecutable, por lo que es más seguro que los formatos basados en pickle. Aun así, descargue modelos solo de fuentes confiables y mantenga actualizado su software de inferencia en caso de errores en el cargador.

Referencias

1GGUF - Wikipediaen.wikipedia.org
2Official GGUF specification (ggml docs)github.com

Siga explorando

en toda la base de datos

Extensiones principales esta semana

1.AQQAQQ Instant Messenger File
2.BINCD/DVD Disc Image (BIN/CUE)
3.MDMarkdown Document
4.RPMSGRestricted Permission Message
5.PARTPartial Download File
6.CRDOWNLOADChrome Partial Download File
7.NOMEDIAAndroid No-Media Marker File
8.PRDXSoftMaker Presentations Document
9.PRO6XProPresenter 6 Bundle File
10.SWFSmall Web Format (Shockwave Flash)

Extensiones relacionadas

.PKPASSApple Wallet Pass (formerly Passbook)
.DATProgram Data File (generic)
.JSONJavaScript Object Notation file
.RISResearch Information Systems citation file
.OFXOpen Financial Exchange
.CSVComma-Separated Values

Herramientas de archivo gratuitas

Un identificador de archivos y convertidor de imágenes en el navegador - todo se ejecuta en su dispositivo.

Abrir la caja de herramientas

Explorar extensiones de archivo A-Z