Arama Yap Mesaj Senden
Rückruf anfordern
+90
X
X

Wählen Sie Ihre Währung

Türkische Lira $ US Dollar Euro
X
X

Wählen Sie Ihre Währung

Türkische Lira $ US Dollar Euro

Kontaktieren Sie uns

Standort Halkali Merkez Viertel Fatih Str. Ozgur Apt. No. 46, Kucukcekmece, Istanbul, 34303, TR

LiteLLM Proxy einrichten: OpenAI-, Gemini-, Claude- und Ollama-APIs verwalten

LiteLLM Proxy mit PostgreSQL und Redis bereitstellen, Anbieter hinter einer OpenAI-kompatiblen API bündeln und virtuelle Schlüssel, Budgets, Limits, TLS und Log-Datenschutz konfigurieren.

LiteLLM Proxy einrichten: OpenAI-, Gemini-, Claude- und Ollama-APIs verwalten
Was läuft am Ende dieser Anleitung?

LiteLLM Proxy mit PostgreSQL und Redis bereitstellen, Anbieter hinter einer OpenAI-kompatiblen API bündeln und virtuelle Schlüssel, Budgets, Limits, TLS und Log-Datenschutz konfigurieren. Beispiel-Domains, Passwörter und Secrets müssen vor der Ausführung durch eigene Werte ersetzt werden.

Architektur und Anforderungen vor der Installation

  • Ubuntu 24.04 LTS mit sudo-Zugriff und eigener IPv4-Adresse
  • Docker Engine und Compose v2 für containerbasierte Bereitstellungen
  • DNS-A-Record vom Anwendungsnamen auf den Server
  • NVMe-Kapazität für Daten, Logs, temporäre Dateien und Backups
  • CPU- und RAM-Reserve anhand gemessener Gleichzeitigkeit

DNS- und Portplan

  • 443/TCP: istemci API erişimi
  • 4000/TCP: yalnız reverse proxy arkasında LiteLLM
  • 5432/TCP: PostgreSQL iç ağ
  • 6379/TCP: Redis iç ağ

Praktische Installationsschritte

1. Sırlar
openssl rand -hex 32
openssl rand -base64 48
2. Ortam dosyası
LITELLM_MASTER_KEY=sk-YONETICI_ICIN_GUCLU_ANAHTAR
LITELLM_SALT_KEY=DEGISTIRILMEMESI_GEREKEN_RASTGELE_DEGER
POSTGRES_PASSWORD=GUCLU_DB_PAROLASI
DATABASE_URL=postgresql://litellm:GUCLU_DB_PAROLASI@postgres:5432/litellm
REDIS_HOST=redis
OPENAI_API_KEY=sk-...
GEMINI_API_KEY=...
ANTHROPIC_API_KEY=...
3. Model yapılandırması
model_list:
  - model_name: gpt-4o-mini
    litellm_params:
      model: openai/gpt-4o-mini
      api_key: os.environ/OPENAI_API_KEY
  - model_name: gemini-flash
    litellm_params:
      model: gemini/gemini-2.5-flash
      api_key: os.environ/GEMINI_API_KEY
  - model_name: claude-sonnet
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: yerel-qwen
    litellm_params:
      model: ollama/qwen3:8b
      api_base: http://ollama:11434
general_settings:
  master_key: os.environ/LITELLM_MASTER_KEY
  database_url: os.environ/DATABASE_URL
4. Compose yapısı
services:
  postgres:
    image: postgres:16-alpine
    restart: unless-stopped
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: ${POSTGRES_PASSWORD}
      POSTGRES_DB: litellm
    volumes:
      - postgres_veri:/var/lib/postgresql/data
  redis:
    image: redis:7-alpine
    restart: unless-stopped
    volumes:
      - redis_veri:/data
  litellm:
    image: ghcr.io/berriai/litellm-database:main-stable
    restart: unless-stopped
    env_file: .env
    command: ["--config", "/app/config.yaml", "--port", "4000"]
    ports:
      - 127.0.0.1:4000:4000
    volumes:
      - ./config.yaml:/app/config.yaml:ro
    depends_on:
      - postgres
      - redis
volumes:
  postgres_veri:
  redis_veri:
5. API doğrulama
curl -sS http://127.0.0.1:4000/health/liveliness
curl -sS http://127.0.0.1:4000/v1/models -H "Authorization: Bearer sk-YONETICI_ICIN_GUCLU_ANAHTAR"
6. Sohbet testi
curl https://llm.example.com/v1/chat/completions \
  -H "Authorization: Bearer sk-SANAL_ANAHTAR" \
  -H "Content-Type: application/json" \
  -d '{"model":"yerel-qwen","messages":[{"role":"user","content":"Merhaba"}]}'
7. Veritabanı yedeği
sudo docker compose exec -T postgres pg_dump -U litellm -d litellm -Fc > litellm-$(date +%F).dump
sha256sum litellm-$(date +%F).dump
8. Nginx reverse proxy
sudo apt update
sudo apt install -y nginx certbot python3-certbot-nginx
sudo tee /etc/nginx/sites-available/llm.example.com > /dev/null <<'NGINX'
server {
    listen 80;
    listen [::]:80;
    server_name llm.example.com;
    client_max_body_size 10G;
    proxy_read_timeout 3600;
    proxy_send_timeout 3600;
    location / {
        proxy_pass http://127.0.0.1:4000;
        proxy_http_version 1.1;
        proxy_set_header Host $host;
        proxy_set_header X-Real-IP $remote_addr;
        proxy_set_header X-Forwarded-For $proxy_add_x_forwarded_for;
        proxy_set_header X-Forwarded-Proto $scheme;
        proxy_set_header Upgrade $http_upgrade;
        proxy_set_header Connection "upgrade";
    }
}
NGINX
sudo ln -s /etc/nginx/sites-available/llm.example.com /etc/nginx/sites-enabled/llm.example.com
sudo nginx -t
sudo systemctl reload nginx
9. Let’s Encrypt SSL ve yenileme testi
sudo certbot --nginx -d llm.example.com --redirect --agree-tos --no-eff-email -m [email protected]
sudo certbot renew --dry-run
curl -I https://llm.example.com
openssl s_client -connect llm.example.com:443 -servername llm.example.com </dev/null 2>/dev/null | openssl x509 -noout -subject -issuer -dates

Wichtige Punkte vor dem Produktivbetrieb

Produktionshinweis
LiteLLM Proxy einrichten muss hinter HTTPS isoliert werden; Datenbank, Queue und interne APIs dürfen nicht direkt im Internet veröffentlicht werden.
Produktionshinweis
Vor Produktion getestete Image-Versionen fixieren. Vor Migrationen Release Notes lesen und ein konsistentes Backup erstellen.
Produktionshinweis
Ein Datenbank-Dump allein kann unvollständig sein. Persistente Dateien, Konfiguration, Schlüssel und exakte Version gemeinsam sichern.
Produktionshinweis
Eine echte Transaktion testen, den Host neu starten und die automatische Wiederherstellung prüfen, bevor produktiver Traffic zugelassen wird.

Häufige Fehler und Ursachen

Belirti / SymptomKök neden ve çözüm / Root cause and fix
Dienst oder Container startet nichtCompose-Konfiguration, Abhängigkeiten, Dateirechte und die erste fatale Logzeile prüfen statt wiederholt neu zu starten.
Domain erreichbar, HTTPS fehlerhaftA/AAAA, Ports 80/443, Proxy-Modus, Zertifikatsprüfung und konkurrierende Reverse Proxies prüfen.
Datenbank oder Queue nicht erreichbarInternen Servicenamen und Credentials prüfen; Datenbankports nicht öffentlich freigeben.
Unter Last instabilRAM-Spitzen, Disk-Latenz, Connection Pools und Worker-Concurrency messen und den Engpass gezielt beheben.

Validierung nach der Installation

  • Alle Dienste laufen und Healthchecks sind erfolgreich
  • Hostname liefert ein gültiges HTTPS-Zertifikat
  • Nur erforderliche Ports sind erreichbar
  • MFA und Notfallzugriff für Administratoren sind eingerichtet
  • Backup-Prüfsummen wurden gespeichert
  • Restore in isolierter Umgebung wurde getestet
  • Keine wiederkehrenden kritischen Fehler in Logs
  • Dienste starten nach einem Host-Neustart automatisch

Offizielle technische Quellen

Passende EKA-Sunucu-Anleitungen

Häufig gestellte Fragen

Ist die Installation produktionsgeeignet?

Ja, nachdem Secrets ersetzt, Zugriffe begrenzt und ein vollständiger Restore erfolgreich getestet wurde.

Reichen Mindestressourcen?

Mindestwerte zeigen nur, dass Software startet. CPU, RAM, IOPS und Speicher anhand echter Last dimensionieren.

Kann Cloudflare verwendet werden?

Ja. Full (strict) TLS sowie Origin-Zertifikat, WebSockets und echte Client-IP korrekt konfigurieren.

Updates automatisch installieren?

Major Releases nicht automatisch installieren. Migrationen prüfen, Backup erstellen und altes Image bereithalten.

Was muss gesichert werden?

Datenbank, Uploads, Volumes, Konfiguration, Schlüssel und genaue Version gemeinsam sichern.

VPS oder GPU-Server?

NVMe-VPS passt für Web-Workloads; Inferenz, OCR-Beschleunigung und Transcoding können eine GPU benötigen.

Kontakt für die Bereitstellung

LiteLLM Proxy mit PostgreSQL und Redis bereitstellen, Anbieter hinter einer OpenAI-kompatiblen API bündeln und virtuelle Schlüssel, Budgets, Limits, TLS und Log-Datenschutz konfigurieren.

GPU-Server ansehenKontakt für die Bereitstellung
Top