by mudler (open source) Linux, macOS, Windows, Docker — CPU/GPU (CUDA, ROCm, Metal)
Самохостируемая OpenAI-совместимая REST API для запуска LLM, изображений, аудио и эмбеддингов локально. Заменяет OpenAI API без изменений в коде — достаточно поменять base URL. Возможности: - Полная совместимость с OpenAI API (chat, completions, embeddings, images, audio) - Поддержка llama.cpp, whisper.cpp, stable-diffusion.cpp, bark - Галерея моделей: установка одной командой - GPU ускорение: CUDA, ROCm, Metal (Apple), Vulkan - Function calling, vision, TTS, STT из коробки - Docker-образ с батарейками - Работает без интернета, данные остаются локально
# Docker (быстрый старт):
docker run -p 8080:8080 \
-v $PWD/models:/build/models \
localai/localai:latest-aio-cpu
# С GPU (CUDA):
docker run --gpus all -p 8080:8080 \
localai/localai:latest-aio-gpu-nvidia-cuda-12
# Загрузить модель через галерею:
curl http://localhost:8080/models/apply -d '{"id": "gpt4all-j"}'
# Использовать как OpenAI API:
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8080/v1", api_key="none")
response = client.chat.completions.create(
model="gpt-4",
messages=[{"role": "user", "content": "Hello"}]
)
Deutsch | Español | français | Японский | Корейский | Português | Русский | Китайский
LocalAI — это движок ИИ с открытым исходным кодом. Запускайте любые модели — LLM, зрение, голос, изображения, видео — на любом оборудовании. GPU не требуется.
Маленькое ядро, а не связка. Каждый бэкенд оборачивает лучший в своём классе движок (llama.cpp, vLLM, whisper.cpp, stable-diffusion, MLX...) в собственный образ, загружаемый только при необходимости модели. Вы ничего не устанавливаете, если вам это не нужно.
)
Создано Ettore Di Giacinto и поддерживается командой LocalAI.
:book: Документация | :speech_balloon: Discord | 💻 Быстрый старт | 🖼️ Модели | ❓ FAQ
https://github.com/user-attachments/assets/08cbb692-57da-48f7-963d-2e7b43883c18
Нажмите, чтобы увидеть больше!
https://github.com/user-attachments/assets/228fa9ad-81a3-4d43-bfb9-31557e14a36c
https://github.com/user-attachments/assets/6270b331-e21d-4087-a540-6290006b381a
https://github.com/user-attachments/assets/cbb03379-23b4-4e3d-bd26-d152f057007f
https://github.com/user-attachments/assets/5ba4ace9-d3df-4795-b7d4-b0b404ea71ee
https://github.com/user-attachments/assets/ed88e34c-fed3-4b83-8a67-4716a9feeb7b
Примечание: DMG не подписан Apple. После установки выполните:
sudo xattr -d com.apple.quarantine /Applications/LocalAI.app. Подробности см. в #6268.
Уже запускали LocalAI ранее? Используйте
docker start -i local-aiдля перезапуска существующего контейнера.
docker run -ti --name local-ai -p 8080:8080 localai/localai:latest
# CUDA 13
docker run -ti --name local-ai -p 8080:8080 --gpus all localai/localai:latest-gpu-nvidia-cuda-13
# CUDA 12
docker run -ti --name local-ai -p 8080:8080 --gpus all localai/localai:latest-gpu-nvidia-cuda-12
# NVIDIA Jetson ARM64 (CUDA 12, для AGX Orin и аналогичных)
docker run -ti --name local-ai -p 8080:8080 --gpus all localai/localai:latest-nvidia-l4t-arm64
# NVIDIA Jetson ARM64 (CUDA 13, для DGX Spark)
docker run -ti --name local-ai -p 8080:8080 --gpus all localai/localai:latest-nvidia-l4t-arm64-cuda-13
docker run -ti --name local-ai -p 8080:8080 --device=/dev/kfd --device=/dev/dri --group-add=video localai/localai:latest-gpu-hipblas
docker run -ti --name local-ai -p 8080:8080 --device=/dev/dri/card1 --device=/dev/dri/renderD128 localai/localai:latest-gpu-intel
docker run -ti --name local-ai -p 8080:8080 localai/localai:latest-gpu-vulkan
# Из галереи моделей (список доступных моделей: `local-ai models list` или на https://models.localai.io)
local-ai run llama-3.2-1b-instruct:q4_k_m
# Из Huggingface
local-ai run huggingface://TheBloke/phi-2-GGUF/phi-2.Q8_0.gguf
# Из реестра OCI Ollama
local-ai run ollama://gemma:2b
# Из YAML-конфига
local-ai run https://gist.githubusercontent.com/.../phi-2.yaml
# Из стандартного реестра OCI (например, Docker Hub)
local-ai run oci://localai/phi-2:latest
Чтобы протестировать работающий сервер LocalAI из терминала, откройте интерактивную сессию чата в другом шелле. Внутри подсказки /models выводит установленные модели, а /model <имя> переключает между ними.
# Терминал 1
local-ai run llama-3.2-1b-instruct:q4_k_m
# Терминал 2
local-ai chat --model llama-3.2-1b-instruct:q4_k_m
Автоматическое определение бэкенда: LocalAI автоматически определяет возможности вашего GPU и загружает соответствующий бэкенд. Дополнительные параметры см. в разделе Ускорение на GPU.
Подробнее смотрите в Руководстве по началу работы.
Старые новости и полные заметки о выпусках смотрите на GitHub Releases и на странице Новости.
llama.cpp, transformers, vllm ... и другие)LocalAI поддерживает более 60 бэкендов, включая llama.cpp, vLLM, SGLang, transformers, whisper.cpp, diffusers, MLX, MLX-VLM и многие другие. Аппаратное ускорение доступно для NVIDIA (CUDA 12/13), AMD (ROCm), Intel (oneAPI/SYCL), Apple Silicon (Metal), Vulkan и NVIDIA Jetson (L4T). Все бэкенды могут быть установлены на лету из Галереи бэкендов.
Смотрите полную Таблицу совместимости бэкендов и моделей и Руководство по ускорению на GPU.
Большинство бэкендов оборачивают лучший в своём классе движок. Несколько из них — это нативные C/C++/GGML-движки (без Python при выводе), разработанные и поддерживаемые самим проектом LocalAI:
| Бэкенд | Что делает |
|---|---|
| parakeet.cpp | C++/GGML-порт ASR NVIDIA NeMo Parakeet (tdt/ctc/rnnt/hybrid) с транскрипцией, aware-кэша |
| voxtral.c | Voxtral Realtime 4B speech-to-text на чистом C |
| vibevoice.cpp | Нативный порт Microsoft VibeVoice для TTS (клонирование голоса) и длинного ASR с диаризацией говорящих |
| rf-detr.cpp | Нативное обнаружение объектов и сегментация экземпляров RF-DETR |
| locate-anything.cpp | Обнаружение объектов с открытым словарем и визуальный граундинг (LocateAnything-3B) |
| depth-anything.cpp | Одномерная метрическая карта глубины Depth Anything 3 + оценка позы камеры |
| privacy-filter.cpp | Автономный GGML-движок классификации токенов для PII/NER, поддерживающий функцию LocalAI по редактированию PII |
| LocalVQE | Совместное подавление акустического эха, шума и реверберации |
| local-store | Локальная векторная база данных для эмбеддингов (включена в дерево исходного кода) |
LocalAI поддерживается небольшой командой людей, совместно с более широким сообществом контрибьюторов.
Огромное спасибо всем, кто вносит код, рецензирует PR, создаетзадачи и помогает пользователям в Discord — LocalAI — это проект, движимый сообществом, и он не существовал бы без вас. Смотрите полный список контрибьюторов.
Если вы используете этот репозиторий, данные в проекте, пожалуйста, рассмотрите возможность его цитирования:
@misc{localai,
author = {Ettore Di Giacinto},
title = {LocalAI: The free, Open source OpenAI alternative},
year = {2023},
publisher = {GitHub},
journal = {GitHub repository},
howpublished = {\url{https://github.com/go-skynet/LocalAI}},
Вы находите LocalAI полезным?
Поддержите проект, став спонсором или бекером. Ваш логотип будет отображен здесь со ссылкой на ваш сайт.
Огромное спасибо нашим щедрым спонсорам, поддерживающим этот проект и покрывающим расходы CI, и наш список спонсоров:
Прошлые спонсоры
Отдельное спасибо индивидуальным спонсорам, полный список на GitHub и buymeacoffee. Особый респект drikster80 за щедрость. Спасибо всем!
LocalAI — проект, движимый сообществом, созданный Ettore Di Giacinto и поддерживаемый командой LocalAI.
MIT - Автор Ettore Di Giacinto mudler@localai.io
LocalAI не мог бы быть создан без помощи отличного программного обеспечения, уже доступного от сообщества. Спасибо!
Это проект сообщества, особая благодарность нашим контрибьюторам!