AI Toolkit

MCP серверы, LSP, скиллы, плагины, AI-модели и другие инструменты

1 инструментов Сбросить

llama.cpp

Framework Dev Tools Open Source

by ggml-org / Georgi Gerganov

✔ GGUF-модели (Llama, Mistral, Qwen и др.), CPU/CUDA/Metal/Vulkan

Инференс LLM на чистом C/C++ без тяжёлых зависимостей — работает буквально везде: от смартфона и Raspberry Pi до серверных GPU-кластеров. Формат GGUF и квантование, которые …

git clone https://github.com/ggml-org/llama.cpp cd llama.cpp cmake -B build -DGGML_CUDA=ON # убрать флаг для CPU-only сборки cmake --build build --config Release ./build/bin/llama-cli -m model.gguf -p "Привет" ./build/bin/llama-server -m model.gguf # HTTP-сервер с веб-интерфейсом