self-hosted llm gateway — openai-compatible, virtual keys, fallback, policies
LAPA принимает запрос по OpenAI-совместимому API и маршрутизирует его к DeepSeek, Claude, GPT, Gemini, GLM, Qwen или локальной модели. Клиент получает виртуальный ключ — реальные ключи провайдеров не покидают сервер.
7 провайдеров, 20+ моделей, 1 эндпоинт, 0 ключей провайдеров у клиента.
| модель | для чего | контекст | вывод | вход | $ вход / вывод |
|---|---|---|---|---|---|
| deepseek-v4-flash | основная: быстрая, недорогая, понимает картинки | 1M | 384k | текст, изображения | 0.30 / 1.20 |
| deepseek-v4-pro | сложные задачи и рассуждения, медленнее | 1M | 384k | текст | 1.32 / 3.96 |
| gemini-3.1-flash-lite | самая дешёвая; лимит 15 запросов в минуту | 1M | 64k | текст, изображения, аудио, видео, PDF | 0.25 / 1.50 |
| gemini-3.5-flash | аудио и видео на вход; временами перегружена у Google | 1M | 64k | текст, изображения, аудио, видео, PDF | 1.50 / 9.00 |
Цены — за 1M токенов по прайс-листам вендоров, DeepSeek вне пика вдвое дешевле. Claude, GPT и остальные модели — по запросу, полный список ниже.
/api/v1: chat completions, стриминг, список моделей.
Смена модели — одна строка в запросе, код клиента не меняется.sk-…. Реальные ключи провайдеров хранятся только на
сервере и наружу не выдаются. Ротация — из кабинета.Поддерживаются облачные и локальные бэкенды. Доступный набор моделей
задаётся на ключе; актуальный список — GET /api/v1/models.
Параметры и цены по данным вендоров.
| провайдер | model | контекст | вывод | вход | $ вход | $ вывод |
|---|---|---|---|---|---|---|
| DeepSeek | deepseek-v4-flash | 1M | 384k | текст, изображения | 0.30 | 1.20 |
| DeepSeek | deepseek-v4-pro | 1M | 384k | текст | 1.32 | 3.96 |
| gemini-3.1-flash-lite | 1M | 64k | текст, изображения, аудио, видео, PDF | 0.25 | 1.50 | |
| gemini-3.5-flash | 1M | 64k | текст, изображения, аудио, видео, PDF | 1.50 | 9.00 | |
| gemini-3.8-flash | 1M | 64k | текст, изображения, аудио, видео, PDF | 0.75 | 3.75 | |
| Anthropic | claude-fable-5-1 | 1M | 128k | текст, изображения, PDF | 10.00 | 50.00 |
| Anthropic | claude-opus-5 | 1M | 128k | текст, изображения, PDF | 5.00 | 25.00 |
| Anthropic | claude-sonnet-5 | 1M | 128k | текст, изображения, PDF | 2.00 | 10.00 |
| Anthropic | claude-haiku-4-5 | 200k | — | текст, изображения, PDF | 1.00 | 5.00 |
| OpenAI | gpt-6-astra | 1M | 128k | текст, изображения | 10.00 | 50.00 |
| OpenAI | gpt-5.6 | 1M | 128k | текст, изображения | 4.00 | 20.00 |
| OpenAI | gpt-5.6-luna | 1M | 128k | текст, изображения | 0.20 | 1.20 |
| Z.AI | glm-5.3 | 1M | 128k | текст | 1.40 | 4.40 |
| Z.AI | glm-5.3-flash | 1M | 128k | текст, изображения, видео, файлы | 0.15 | 0.50 |
| Локально | local-llama | — | — | зависит от бэкенда | — | — |
Контекст и вывод — в токенах, цены — за 1M токенов без кэша по прайс-листам вендоров на 22.09.2026. DeepSeek — пиковый тариф, вне пика вдвое дешевле. Gemini 3.8 Flash — цена до 31.12.2026. Qwen3.8 (Max, Flash, Omni) роутер поддерживает, но открытых характеристик у вендора нет — добавим при подключении.
Получите виртуальный ключ и работайте с LAPA как с обычным OpenAI API — меняется только
base_url. Три варианта: curl, Python, OpenCode.
curl https://lapa.interforum.su/api/v1/chat/completions \
-H "Authorization: Bearer $LAPA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Привет"}]}'import os
from openai import OpenAI
client = OpenAI(
base_url="https://lapa.interforum.su/api/v1",
api_key=os.environ["LAPA_API_KEY"],
)
r = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Привет"}],
)
print(r.choices[0].message.content)// ~/.config/opencode/opencode.jsonc — один провайдер, много моделей
{
"provider": {
"lapa": {
"npm": "@ai-sdk/openai-compatible",
"name": "LAPA",
"options": {
"baseURL": "https://lapa.interforum.su/api/v1",
"apiKey": "{env:LAPA_API_KEY}"
},
"models": {
"deepseek-v4-flash": { "name": "DeepSeek V4 Flash" },
"deepseek-v4-pro": { "name": "DeepSeek V4 Pro" },
"gemini-3.5-flash": { "name": "Gemini 3.5 Flash" }
}
}
},
"model": "lapa/deepseek-v4-flash"
}Нужен ключ, отдельная модель или интеграция? Напишите — подключим.