self-hosted llm gateway
openai-compatible · virtual keys · fallback · policies

Один эндпоинт. Все модели. Ваш сервер.

LAPA принимает запрос по OpenAI-совместимому API и маршрутизирует его к DeepSeek, Claude, GPT, Gemini, GLM, Qwen или локальной модели. Клиент получает виртуальный ключ — реальные ключи провайдеров не покидают сервер.

7провайдеров
20+моделей
1эндпоинт
0ключей провайдеров у клиента
↓ scroll to explore
01

Возможности

01

Единый эндпоинт

OpenAI-совместимый /api/v1: chat completions, стриминг, список моделей. Смена модели — одна строка в запросе, код клиента не меняется.

02

Виртуальные ключи

Каждому клиенту — свой sk-…. Реальные ключи провайдеров хранятся только на сервере и наружу не выдаются. Ротация — из кабинета.

03

Бюджеты и лимиты

Бюджет и лимит запросов на каждый ключ. Разрешённый набор моделей — тоже на уровне ключа. Превышение — отказ, а не счёт в конце месяца.

04

Fallback-цепочки

Ошибка провайдера, перегрузка или исчерпанная квота — запрос уходит на следующую модель в цепочке. Клиент получает ответ, а не 5xx.

05

Учёт и статистика

Расход по ключам и моделям, число запросов, токены. Клиент видит свою статистику в кабинете, без доступа к чужим данным.

06

Политики доступа

Правила на уровне ключа: фильтр prompt-injection, запрет тем, часовые окна доступа. Проверка до отправки запроса в модель.

07

Агенты и инструменты

Tool calling и агентные сценарии. OpenCode подключается как один провайдер со всеми моделями. Мультимодальность — изображения на вход. Водяной знак в сгенерированном коде.

08

Self-hosted

Ваша инфраструктура, ваши данные. Кэш ответов, стриминг, HTTPS. Никаких посредников между вами и провайдером.

02

Модели и провайдеры

Поддерживаются облачные и локальные бэкенды. Доступный набор моделей задаётся на ключе; актуальный список — GET /api/v1/models.

DeepSeek · V4.1 Flash основная vision 1M ctx · V4 Pro reasoning
Anthropic · Claude Fable 5.1 frontier · Opus 5 · Sonnet 5 · Haiku 4.5
OpenAI · GPT-6 Astra новое · GPT-5.6 sol terra luna
Google · Gemini 3.8 Flash новое 1M ctx · 3.1 Pro · 3.5 Flash
Z.AI · GLM-5.3 open weights · GLM-5.3 Flash vision video
Qwen · Qwen3.8 Max · Qwen3.8 Flash · Omni Flash audio video
Local · Ollama · vLLM · LM Studio Qwen 3.8 GLM-5.3 Llama · любой OpenAI-совместимый бэкенд
03

Быстрый старт

Получите виртуальный ключ и работайте с LAPA как с обычным OpenAI API — меняется только base_url. Три варианта: curl, Python, OpenCode.

# 1. curl
curl https://lapa.interforum.su/api/v1/chat/completions \
  -H "Authorization: Bearer $LAPA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Привет"}]}'

# 2. python (openai sdk)
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://lapa.interforum.su/api/v1",
    api_key=os.environ["LAPA_API_KEY"],
)
r = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Привет"}],
)
print(r.choices[0].message.content)

# 3. opencode — ~/.config/opencode/opencode.jsonc (один провайдер, много моделей)
{
  "provider": {
    "lapa": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "LAPA",
      "options": {
        "baseURL": "https://lapa.interforum.su/api/v1",
        "apiKey": "{env:LAPA_API_KEY}"
      },
      "models": {
        "deepseek-v4-flash": { "name": "DeepSeek V4 Flash" },
        "deepseek-v4-pro":   { "name": "DeepSeek V4 Pro" },
        "gemini-3.5-flash":  { "name": "Gemini 3.5 Flash" }
      }
    }
  },
  "model": "lapa/deepseek-v4-flash"
}
04

Доступ

Нужен ключ, отдельная модель или интеграция? Напишите — подключим.