.GGUF

Файл GGUF

GGML Universal Format File
Задать вопрос
БЫСТРЫЙ ОТВЕТ

Файл .gguf - это файл формата GGML Universal Format, бинарный контейнер, используемый llama.cpp и сопутствующими инструментами для хранения больших языковых моделей в виде одного файла. Он содержит веса модели, токенизатор и все метаданные вместе, обычно в квантованном виде, чтобы модель могла работать на обычном оборудовании. Открыть или запустить модель .gguf можно с помощью локальных приложений для инференса, таких как LM Studio, Ollama, Jan или GPT4All, либо загрузить её напрямую через llama.cpp.

Разработчик: Georgi Gerganov and the ggml/llama.cpp community Категория: Файлы данных Открыть стандартное MIME: application/octet-stream
ОТКРЫВАЕТСЯ НА Windows macOS Linux Web
Связанные: .PKPASS · .DAT · .JSON · .RIS

На этой странице

Проиндексировано расширений: 19k+
Последняя проверка: Sep 4, 2026

Не знаете, что это за файл?

Перетащите любой файл в наш идентификатор - мы прочитаем первые байты, чтобы определить формат.

Идентифицировать файл

Что такое формат файла GGUF?

Файл .gguf - это GGML Universal Format File, бинарный контейнер, используемый llama.cpp для хранения больших языковых моделей. Георгий Герганов и сообщество ggml представили его в августе 2023 года как преемника старых форматов GGML, GGMF и GGJT. Один файл .gguf содержит веса модели, токенизатор и все гиперпараметры в виде типизированных метаданных «ключ-значение», поэтому для загрузки и запуска модели не требуются отдельные конфигурационные файлы.

Формат разработан как самодостаточный, расширяемый и поддерживающий отображение в память (memory-mappable). Поскольку метаданные хранятся в виде пар «ключ-значение» с пространствами имен, а не в виде фиксированного списка, новые поля можно добавлять без нарушения работы старых программ чтения. Веса обычно квантуются (от 2 до 8 бит, включая K-кванты, такие как Q4_K_M), что позволяет запускать объемные модели на потребительских CPU и GPU. Каждый файл начинается с четырехбайтовой магической строки GGUF, за которой следует номер версии; текущая версия - 3.

Безопасность и защита

РИСК: LOW

GGUF is a data container for model weights and metadata, not an executable, so opening one does not run code by itself. The main practical risks are large file sizes and downloading models from untrusted sources; a malformed file could in theory exploit a bug in the loader, so use up-to-date inference tools and reputable model repositories.

Детали формата

в двух словах
ПОЛНОЕ НАЗВАНИЕGGML Universal Format Fileтакже известен как GGML Universal File, GGUF model
РАЗРАБОТЧИКGeorgi Gerganov and the ggml/llama.cpp communityс August 2023
КАТЕГОРИЯФайлы данных
MIME-ТИПapplication/octet-stream
ТИПBinary
СТАНДАРТОткрытый · без роялти
СВЯЗАННЫЕ.pkpass.dat.json.ris
Это расширение также используется в…
  • Genome Graphical User Format - Rarely, .gguf has been used ad hoc by hobby projects for GUI layout data, unrelated to the machine-learning format described here.
MAGIC BYTES · СИГНАТУРА ФАЙЛА
СМЕЩЕНИЕ
00010203
HEX
47475546
ASCII
GGUF
First 4 bytes are the ASCII string GGUF (0x47 0x47 0x55 0x46), followed by a 4-byte version, 8-byte tensor count and 8-byte metadata count.

Программы, открывающие файлы GGUF

Windows6 apps
LM Studio Freemium Browse, download and chat with .gguf models through a desktop GUI, with per-model quantization choices.
Ollama Открытый код Load a local .gguf file via a Modelfile and serve it for chat or API use with one command.
llama.cpp Открытый код Run inference directly on a .gguf model with llama-cli or llama-server, the reference implementation of the format.
Jan Открытый код Import a .gguf file and run it fully offline in a ChatGPT-style desktop app.
GPT4All Открытый код Add a downloaded .gguf model to the local model folder and chat with it offline.
koboldcpp Открытый код Load a .gguf model for text generation and roleplay with a self-contained executable.
macOS4 apps
LM Studio Freemium Download and run .gguf models with Apple Silicon acceleration through a desktop GUI.
Ollama Открытый код Serve a local .gguf model via a Modelfile using Metal acceleration on Apple hardware.
llama.cpp Открытый код Run .gguf models with llama-cli, built with Metal support for Apple Silicon.
Jan Открытый код Import and run .gguf models offline in a native desktop client.
Linux4 apps
llama.cpp Открытый код Build from source and run .gguf models with CUDA, ROCm or CPU backends via llama-cli and llama-server.
Ollama Открытый код Register a local .gguf file with a Modelfile and serve it over the Ollama API.
LM Studio Freemium Run .gguf models with a desktop GUI and GPU offload on supported hardware.
text-generation-webui Открытый код Load .gguf models through the llama.cpp loader in a browser-based interface.
Web1 app
Hugging Face GGUF viewer Бесплатно Inspect a .gguf file's metadata, tensor list and quantization in the browser without downloading it.

Технические подробности

глубокая спецификация
EncodingBinary
Byte orderLittle-endian by default; big-endian supported since version 3
ContainerSingle-file container holding header, metadata key-value block, tensor info block and raw tensor data
CompressionNone as a container; weights are stored using GGUF quantization schemes (Q2 through Q8, K-quants such as Q4_K_M, IQ variants, plus F16/BF16/F32)
Typical sizeRoughly 0.5 GB to over 100 GB depending on parameter count and quantization level
StructureHeader (magic, version, tensor count, metadata count) then namespaced key-value metadata, then per-tensor info (name, dimensions, type, offset), then aligned raw tensor data. Default alignment is 32 bytes and must be a multiple of 8.
IntegrityNo built-in checksum; the metadata block is self-describing and validated at load time
PlatformsWindows, macOS, Linux
NotesA GGUF file is self-contained: it bundles the model weights, tokenizer and all hyperparameters as typed metadata, so no separate config files are needed. Metadata keys use lower_snake_case with period-separated namespaces and keys can be up to 65,535 bytes. Over 40 quantization types are supported. Large models can be sharded across multiple .gguf files with llama-gguf-split.
ВыпущенAugust 2023
Последняя версияVersion 3
Открыть стандартноеДа · без роялти
Спецификацияgithub.com

Конвертации GGUF

Вопросы и ответы сообщества

спрошено пользователями
Задать быстрый вопрос
Получите помощь от людей, работающих с файлами GGUF. Будьте конкретны - укажите вашу систему и версию ПО.
Аккаунт не нужен · ответы обычно в течение дня

Вопросов пока нет - станьте первым, кто спросит о файлах GGUF.

Часто задаваемые вопросы

Как открыть файл GGUF?
Используйте локальный раннер LLM, такой как LM Studio, Ollama, Jan или GPT4All, либо загрузите его напрямую через llama.cpp. Эти инструменты читают файл .gguf и позволяют общаться с моделью. Двойной клик по файлу сам по себе ничего не даст.
Какая программа создает файлы GGUF?
Они создаются конвертационными скриптами llama.cpp, в основном convert_hf_to_gguf.py, который превращает модель Hugging Face в .gguf, после чего опционально используется llama-quantize для уменьшения размера до нужного квантования, например Q4_K_M.
Что означает Q4_K_M в имени файла GGUF?
Это тип квантования. Q4 означает примерно 4-битные веса, K относится к методу K-quant на основе блоков, а M - это вариант среднего (medium) размера/качества. Меньшие числа дают файлы меньшего размера и более низкого качества; F16 или F32 не квантованы.
Можно ли конвертировать файл GGUF обратно в исходную модель?
Частично. Вы можете деквантовать его в веса .safetensors или PyTorch с помощью скриптов сообщества, но так как большинство файлов GGUF квантованы, преобразование идет с потерями и не восстанавливает точные исходные веса.
Почему мой файл GGUF такой большой?
Файл .gguf содержит все веса модели в одном файле. Размер файла масштабируется в зависимости от количества параметров и уровня квантования, поэтому большая модель с высокой точностью может легко превышать десятки гигабайт.
Безопасно ли скачивать файлы GGUF?
Сам формат не содержит исполняемого кода, поэтому он безопаснее форматов на базе pickle. Тем не менее, скачивайте модели только из доверенных источников и обновляйте ПО для инференса на случай ошибок в загрузчике.

Ссылки

1GGUF - Wikipediaen.wikipedia.org
2Official GGUF specification (ggml docs)github.com

Узнать больше

по всей базе данных

Популярные расширения на этой неделе

1.AQQAQQ Instant Messenger File
2.BINCD/DVD Disc Image (BIN/CUE)
3.MDMarkdown Document
4.RPMSGRestricted Permission Message
5.PARTPartial Download File
6.CRDOWNLOADChrome Partial Download File
7.NOMEDIAAndroid No-Media Marker File
8.PRDXSoftMaker Presentations Document
9.PRO6XProPresenter 6 Bundle File
10.SWFSmall Web Format (Shockwave Flash)

Похожие расширения

.PKPASSApple Wallet Pass (formerly Passbook)
.DATProgram Data File (generic)
.JSONJavaScript Object Notation file
.RISResearch Information Systems citation file
.OFXOpen Financial Exchange
.CSVComma-Separated Values

Бесплатные инструменты для файлов

Идентификатор файлов и конвертер изображений в браузере - все работает на вашем устройстве.

Открыть инструменты

Обзор расширений файлов A-Z