Bei API-Servern zählen RPS, Payload-Größe, DB-Query-Kosten und Parallelverbindungen mehr als Gesamtuser. Ohne Traffic-Messung kann CPU/RAM über- oder unterdimensioniert werden.
Peak RPS, p50/p95/p99-Latenz, Error Rate, Timeouts, DB-Query-Zeit, Connection Pool, CPU, RAM und Queue Lag sind Kernmetriken. Bei Webhooks zusätzlich Retry und Idempotency.
TLS-Terminierung, Rate Limits und Request Logging können vor der App im Edge/Reverse Proxy erfolgen.
RPS allein reicht nicht; 50 RPS mit teuren DB-Queries können schwerer sein als 500 gecachte RPS.
Authentication, Authorization, Rate Limits, Schema Validation, Secrets und Audit Logs gemeinsam umsetzen.
APM mit Host-Socket- und Ressourcen-Sicht ergänzen.
ss -sss -lntpuptimefree -hps aux --sort=-%cpu | headjournalctl -p warning --since '-15 min'App zuerst stateless machen, dann zweite Instanz hinter Load Balancer hinzufügen.
Abhängig von Peak RPS, CPU-Zeit pro Request und DB-Kosten. Feste Zahl ohne Lasttest ist unzuverlässig.
Nicht zwingend, aber Reverse Proxy hilft bei TLS, Buffering, Rate Limit und Logs.
Schwere Arbeit vom Request zu trennen verbessert Retry und Resilienz.
Teilen Sie Peak RPS, Framework, DB, Payload und Timeout-Profil; passende VPS/VDS-Topologie planen.