.GGUF

File GGUF

GGML Universal Format File
Fai una domanda
RISPOSTA RAPIDA

Un file .gguf è un file GGML Universal Format, il contenitore binario utilizzato da llama.cpp e strumenti correlati per memorizzare un modello linguistico di grandi dimensioni come file singolo. Contiene i pesi del modello, il tokenizer e tutti i metadati insieme, solitamente quantizzati affinché il modello possa essere eseguito su hardware comune. Apri o esegui un modello .gguf con un'app di inferenza locale come LM Studio, Ollama, Jan o GPT4All, oppure caricalo direttamente con llama.cpp.

Sviluppatore: Georgi Gerganov and the ggml/llama.cpp community Categoria: File di dati Standard aperto MIME: application/octet-stream
SI APRE SU Windows macOS Linux Web
Correlati: .PKPASS · .DAT · .JSON · .RIS

In questa pagina

19k+ estensioni indicizzate
Ultima revisione Sep 4, 2026

Non sei sicuro di cosa sia il tuo file?

Trascina qualsiasi file nel nostro identificatore - leggiamo solo i primi byte per dare un nome al formato.

Identifica un file

Che cos'è il formato di file GGUF?

Un file .gguf è un file GGML Universal Format, il contenitore binario utilizzato da llama.cpp per memorizzare un modello linguistico di grandi dimensioni. Georgi Gerganov e la comunità ggml lo hanno introdotto nell'agosto 2023 come successore dei vecchi formati GGML, GGMF e GGJT. Un singolo file .gguf contiene i pesi del modello, il tokenizer e ogni iperparametro come metadati chiave-valore tipizzati, quindi non sono necessari file di configurazione separati per caricare ed eseguire il modello.

Il formato è progettato per essere autonomo, estensibile e mappabile in memoria. Poiché i metadati sono memorizzati come coppie chiave-valore con namespace invece di un elenco fisso, è possibile aggiungere nuovi campi senza interrompere i lettori più vecchi. I pesi sono solitamente quantizzati, da 2-bit fino a 8-bit e includendo K-quants come Q4_K_M, il che consente a modelli di dimensioni considerevoli di girare su CPU e GPU consumer. Ogni file inizia con la stringa magica di quattro byte GGUF, seguita da un numero di versione; la versione attuale è la 3.

Sicurezza e incolumità

RISCHIO: LOW

GGUF is a data container for model weights and metadata, not an executable, so opening one does not run code by itself. The main practical risks are large file sizes and downloading models from untrusted sources; a malformed file could in theory exploit a bug in the loader, so use up-to-date inference tools and reputable model repositories.

Dettagli del formato

in sintesi
NOME COMPLETOGGML Universal Format Fileanche noto come GGML Universal File, GGUF model
SVILUPPATOREGeorgi Gerganov and the ggml/llama.cpp communitydal August 2023
CATEGORIAFile di dati
TIPO MIMEapplication/octet-stream
TIPOBinary
STANDARDAperto · royalty-free
Questa estensione è usata anche da…
  • Genome Graphical User Format - Rarely, .gguf has been used ad hoc by hobby projects for GUI layout data, unrelated to the machine-learning format described here.
MAGIC BYTES · FIRMA DEL FILE
OFFSET
00010203
HEX
47475546
ASCII
GGUF
First 4 bytes are the ASCII string GGUF (0x47 0x47 0x55 0x46), followed by a 4-byte version, 8-byte tensor count and 8-byte metadata count.

Programmi che aprono file GGUF

Windows6 apps
LM Studio Freemium Browse, download and chat with .gguf models through a desktop GUI, with per-model quantization choices.
Ollama Open-source Load a local .gguf file via a Modelfile and serve it for chat or API use with one command.
llama.cpp Open-source Run inference directly on a .gguf model with llama-cli or llama-server, the reference implementation of the format.
Jan Open-source Import a .gguf file and run it fully offline in a ChatGPT-style desktop app.
GPT4All Open-source Add a downloaded .gguf model to the local model folder and chat with it offline.
koboldcpp Open-source Load a .gguf model for text generation and roleplay with a self-contained executable.
macOS4 apps
LM Studio Freemium Download and run .gguf models with Apple Silicon acceleration through a desktop GUI.
Ollama Open-source Serve a local .gguf model via a Modelfile using Metal acceleration on Apple hardware.
llama.cpp Open-source Run .gguf models with llama-cli, built with Metal support for Apple Silicon.
Jan Open-source Import and run .gguf models offline in a native desktop client.
Linux4 apps
llama.cpp Open-source Build from source and run .gguf models with CUDA, ROCm or CPU backends via llama-cli and llama-server.
Ollama Open-source Register a local .gguf file with a Modelfile and serve it over the Ollama API.
LM Studio Freemium Run .gguf models with a desktop GUI and GPU offload on supported hardware.
text-generation-webui Open-source Load .gguf models through the llama.cpp loader in a browser-based interface.
Web1 app
Hugging Face GGUF viewer Gratuito Inspect a .gguf file's metadata, tensor list and quantization in the browser without downloading it.

Dettagli tecnici

specifiche approfondite
EncodingBinary
Byte orderLittle-endian by default; big-endian supported since version 3
ContainerSingle-file container holding header, metadata key-value block, tensor info block and raw tensor data
CompressionNone as a container; weights are stored using GGUF quantization schemes (Q2 through Q8, K-quants such as Q4_K_M, IQ variants, plus F16/BF16/F32)
Typical sizeRoughly 0.5 GB to over 100 GB depending on parameter count and quantization level
StructureHeader (magic, version, tensor count, metadata count) then namespaced key-value metadata, then per-tensor info (name, dimensions, type, offset), then aligned raw tensor data. Default alignment is 32 bytes and must be a multiple of 8.
IntegrityNo built-in checksum; the metadata block is self-describing and validated at load time
PlatformsWindows, macOS, Linux
NotesA GGUF file is self-contained: it bundles the model weights, tokenizer and all hyperparameters as typed metadata, so no separate config files are needed. Metadata keys use lower_snake_case with period-separated namespaces and keys can be up to 65,535 bytes. Over 40 quantization types are supported. Large models can be sharded across multiple .gguf files with llama-gguf-split.
RilasciatoAugust 2023
Ultima versioneVersion 3
Standard aperto · royalty-free
Specificagithub.com

Conversioni GGUF

Domande e risposte della community

chiesto dagli utenti
Fai una domanda veloce
Ottieni aiuto da persone che lavorano con i file GGUF. Sii specifico - includi il tuo sistema e la versione del software.
Nessun account necessario · risposte solitamente entro un giorno

Ancora nessuna domanda - sii il primo a chiedere informazioni sui file GGUF.

Domande frequenti

Come apro un file GGUF?
Usa un runner LLM locale come LM Studio, Ollama, Jan o GPT4All, oppure caricalo direttamente con llama.cpp. Questi strumenti leggono il file .gguf e ti permettono di chattare con il modello. Fare doppio clic sul file non farà nulla di utile da solo.
Quale programma crea i file GGUF?
Sono prodotti dagli script di conversione di llama.cpp, principalmente convert_hf_to_gguf.py, che trasforma un modello Hugging Face in un .gguf, opzionalmente seguito da llama-quantize per ridurlo a una quantizzazione più piccola come Q4_K_M.
Cosa significa Q4_K_M nel nome di un file GGUF?
È il tipo di quantizzazione. Q4 significa approssimativamente pesi a 4-bit, K si riferisce al metodo K-quant basato su blocchi e M è la variante di dimensioni/qualità media (medium). Numeri più bassi generano file più piccoli e qualità inferiore; F16 o F32 non sono quantizzati.
Posso convertire un file GGUF nel modello originale?
In parte. Puoi dequantizzarlo in .safetensors o pesi PyTorch con script della comunità, ma poiché la maggior parte dei file GGUF è quantizzata, la conversione è lossy e non ripristina gli esatti pesi originali.
Perché il mio file GGUF è così grande?
Un .gguf contiene ogni peso del modello in un unico file. La dimensione del file scala con il numero di parametri e il livello di quantizzazione, quindi un modello grande ad alta precisione può facilmente superare le decine di gigabyte.
I file GGUF sono sicuri da scaricare?
Il formato in sé non contiene codice eseguibile, quindi è più sicuro dei formati basati su pickle. Tuttavia, scarica i modelli solo da fonti attendibili e mantieni aggiornato il software di inferenza in caso di bug nel caricatore.

Riferimenti

1GGUF - Wikipediaen.wikipedia.org
2Official GGUF specification (ggml docs)github.com

Continua a esplorare

nel database

Migliori estensioni della settimana

1.AQQAQQ Instant Messenger File
2.BINCD/DVD Disc Image (BIN/CUE)
3.MDMarkdown Document
4.RPMSGRestricted Permission Message
5.PARTPartial Download File
6.CRDOWNLOADChrome Partial Download File
7.NOMEDIAAndroid No-Media Marker File
8.PRDXSoftMaker Presentations Document
9.PRO6XProPresenter 6 Bundle File
10.SWFSmall Web Format (Shockwave Flash)

Estensioni correlate

.PKPASSApple Wallet Pass (formerly Passbook)
.DATProgram Data File (generic)
.JSONJavaScript Object Notation file
.RISResearch Information Systems citation file
.OFXOpen Financial Exchange
.CSVComma-Separated Values

Strumenti file gratuiti

Un identificatore di file e convertitore di immagini nel browser - tutto viene eseguito sul tuo dispositivo.

Apri la cassetta degli attrezzi

Sfoglia le estensioni dei file A-Z