AI Toolkit

MCP серверы, LSP, скиллы, плагины, AI-модели и другие инструменты

4 инструментов Сбросить

Ollama

v0.32.4
Framework Dev Tools Open Source

by Ollama

✔ Llama, DeepSeek, Qwen, Gemma и др. открытые модели

Запускает большие языковые модели локально одной командой — без ручной настройки окружения, драйверов и весов. Скачивает, квантует и обслуживает модели через простой CLI и OpenAI-совместимый …

curl -fsSL https://ollama.com/install.sh | sh ollama run llama3.2 ollama pull deepseek-r1 # OpenAI-совместимый API на localhost:11434

llama.cpp

Framework Dev Tools Open Source

by ggml-org / Georgi Gerganov

✔ GGUF-модели (Llama, Mistral, Qwen и др.), CPU/CUDA/Metal/Vulkan

Инференс LLM на чистом C/C++ без тяжёлых зависимостей — работает буквально везде: от смартфона и Raspberry Pi до серверных GPU-кластеров. Формат GGUF и квантование, которые …

git clone https://github.com/ggml-org/llama.cpp cd llama.cpp cmake -B build -DGGML_CUDA=ON # убрать флаг для CPU-only сборки cmake --build build --config Release ./build/bin/llama-cli -m model.gguf -p "Привет" ./build/bin/llama-server -m model.gguf # HTTP-сервер с веб-интерфейсом

llamafile

v0.10.3
Framework Dev Tools Open Source

by Mozilla

✔ Windows, macOS, Linux, FreeBSD

Формат дистрибуции LLM от Mozilla: один исполняемый файл содержит и модель, и веб-сервер, и CLI. Работает на любой платформе без установки зависимостей — просто скачать …

# Скачать готовый llamafile (пример: Mistral 7B) curl -LO https://huggingface.co/Mozilla/Mistral-7B-Instruct-v0.2-llamafile/resolve/main/mistral-7b-instruct-v0.2.Q4_0.llamafile chmod +x mistral-7b-instruct-v0.2.Q4_0.llamafile ./mistral-7b-instruct-v0.2.Q4_0.llamafile # Откроет браузер с чатом на localhost:8080 # Также доступен OpenAI-совместимый API

vLLM

v0.26.0
Framework Dev Tools Open Source

by vLLM Project (UC Berkeley)

✔ OpenAI API, HuggingFace models, множество GPU-бэкендов

Инференс-движок для больших языковых моделей с экстремальной пропускной способностью: ключевая технология — PagedAttention, управляющая памятью GPU как виртуальной памятью ОС, что позволяет обслуживать в разы …

pip install vllm vllm serve meta-llama/Llama-3.1-8B-Instruct # Поднимает OpenAI-совместимый API на localhost:8000