GGUF SAFETENSORS
Conversione file

Converti GGUF in SAFETENSORS

RISPOSTA RAPIDA
È possibile convertire GGUF in SAFETENSORS?
- GGUF si converte in SAFETENSORS.

Esegui un convertitore come gguf_to_safetensors o GGUF2Safetensors; legge il GGUF con la libreria gguf, esegue l'upcast di ogni tensore a F16 (o BF16) e scrive i file .safetensors. Aspettati che l'output sia un'approssimazione dei pesi originali ogni volta che il GGUF è stato quantizzato al di sotto di F16.

Anche in SAFETENSORS: PICKLE

In questa pagina

Testato su macOS, Windows e Linux
Ultima verifica Sep 2026

Altri convertitori gratuiti

HEIC, PNG, WEBP, MP3 e altri - ogni strumento qui è gratuito.

Apri la cassetta degli attrezzi

Perché convertire GGUF in SAFETENSORS?

Convertire .gguf in .safetensors consente di caricare nuovamente un modello in Hugging Face Transformers o diffusers, perfezionarlo (fine-tune) o ri-quantizzarlo in modo diverso. GGUF è ottimizzato per l'inferenza con llama.cpp, mentre .safetensors è il formato standard senza pickle per l'ecosistema PyTorch/HF. Nota che le revisioni molto recenti del formato GGUF non sono sempre convertibili.

Come convertire GGUF in SAFETENSORS

gguf_to_safetensors OPEN-SOURCE

Esegui python gguf_to_safetensors.py --input model.gguf --output model.safetensors. L'impostazione predefinita è F16; aggiungi --bf16 per l'output in BF16.

GGUF2Safetensors OPEN-SOURCE

Esegue l'upcast dei pesi GGUF in tensori PyTorch in memoria e scrive una cartella Hugging Face di shard .safetensors, utilizzabile direttamente con Transformers.

libreria gguf + safetensors FREE

Carica con GGUFReader, chiama gguf.quants.dequantize() per ogni tensore, quindi safetensors.torch.save_file(). Controllo completo su dtype e sharding.

Informazioni su questi formati

Qualità e a cosa prestare attenzione

  • La dequantizzazione di un GGUF quantizzato (Q4/Q5/ecc.) è lossy: il file .safetensors non corrisponderà al modello originale bit per bit.
  • Le versioni più recenti del formato GGUF potrebbero non essere convertite perché gli strumenti software sono in ritardo rispetto alle modifiche di llama.cpp.
  • L'output è F16/BF16 (o F32), quindi la dimensione del file aumenta significativamente rispetto al GGUF quantizzato compatto.

Domande frequenti

La conversione da GGUF a safetensors è lossless?
Solo se il GGUF è stato memorizzato in F16/F32. Qualsiasi quantizzazione inferiore viene dequantizzata in modo approssimativo e non può essere invertita esattamente.
Perché il mio recente GGUF non è stato convertito?
GGUF si evolve rapidamente; alcuni convertitori sono bloccati su revisioni precedenti e non possono analizzare file o tipi di quantizzazione più recenti.
Posso caricare il risultato in Hugging Face Transformers?
Sì, se produci una cartella HF corretta (configurazione più .safetensors suddivisi), che è l'obiettivo di GGUF2Safetensors.
Output F16 o BF16?
BF16 preserva meglio la gamma dinamica per i modelli di grandi dimensioni; F16 è supportato più universalmente. Scegli in base alla tua configurazione di addestramento.