LiteLLM Proxy einrichten: OpenAI-, Gemini-, Claude- und Ollama-APIs verwalten
LiteLLM Proxy mit PostgreSQL und Redis bereitstellen, Anbieter hinter einer OpenAI-kompatiblen API bündeln und virtuelle Schlüssel, Budgets, Limits, TLS und Log-Datenschutz konfigurieren.
Was läuft am Ende dieser Anleitung?
LiteLLM Proxy mit PostgreSQL und Redis bereitstellen, Anbieter hinter einer OpenAI-kompatiblen API bündeln und virtuelle Schlüssel, Budgets, Limits, TLS und Log-Datenschutz konfigurieren. Beispiel-Domains, Passwörter und Secrets müssen vor der Ausführung durch eigene Werte ersetzt werden.
Architektur und Anforderungen vor der Installation
Ubuntu 24.04 LTS mit sudo-Zugriff und eigener IPv4-Adresse
Docker Engine und Compose v2 für containerbasierte Bereitstellungen
DNS-A-Record vom Anwendungsnamen auf den Server
NVMe-Kapazität für Daten, Logs, temporäre Dateien und Backups
CPU- und RAM-Reserve anhand gemessener Gleichzeitigkeit
Ja, nachdem Secrets ersetzt, Zugriffe begrenzt und ein vollständiger Restore erfolgreich getestet wurde.
Reichen Mindestressourcen?
Mindestwerte zeigen nur, dass Software startet. CPU, RAM, IOPS und Speicher anhand echter Last dimensionieren.
Kann Cloudflare verwendet werden?
Ja. Full (strict) TLS sowie Origin-Zertifikat, WebSockets und echte Client-IP korrekt konfigurieren.
Updates automatisch installieren?
Major Releases nicht automatisch installieren. Migrationen prüfen, Backup erstellen und altes Image bereithalten.
Was muss gesichert werden?
Datenbank, Uploads, Volumes, Konfiguration, Schlüssel und genaue Version gemeinsam sichern.
VPS oder GPU-Server?
NVMe-VPS passt für Web-Workloads; Inferenz, OCR-Beschleunigung und Transcoding können eine GPU benötigen.
Kontakt für die Bereitstellung
LiteLLM Proxy mit PostgreSQL und Redis bereitstellen, Anbieter hinter einer OpenAI-kompatiblen API bündeln und virtuelle Schlüssel, Budgets, Limits, TLS und Log-Datenschutz konfigurieren.