# LLM-Gateways & Kosten-Tracking-Tools

> Cut My AI Spend — rank #10 of 10. Typische Ersparnis: Ops-Ebene, die Methoden 2–9 erst freischaltet. Aufwand: Niedrig — im Wesentlichen ein Proxy-Tausch.

Ein Gateway (LiteLLM, Portkey, OpenRouter) gibt Ihnen eine API über alle Anbieter hinweg plus die Kontrollpunkte, die jede andere Methode braucht: Caching, Routing, Fallbacks, Budgets, Rate Limits und Kostenlogging pro Request. Kosten-Tracking-Ebenen (Helicone — nach der Mintlify-Übernahme nur noch im Wartungsmodus — nOps, native Anbieter-Dashboards) liefern die Sichtbarkeit.
Für sich allein spart ein Gateway wenig; als Durchsetzungspunkt für Caching, Routing und Kostenzuordnung macht es die Einsparungen systematisch statt einmalig.

## So setzen Sie es um

1. Sämtlichen LLM-Traffic durch ein Gateway leiten; direkte Anbieter-SDK-Aufrufe im Code-Review verbieten.
2. Request-Logging mit Kosten-Metadaten vom ersten Tag an aktivieren.
3. Anbieter-Fallbacks (Ausfallsicherheit) und Budget-Limits (Schutz vor Kostenexplosionen) einschalten.
4. Caching- und Routing-Richtlinien im Gateway hinterlegen statt pro App.

## Häufig gestellte Fragen

### Welches Gateway soll ich nehmen?

LiteLLM (Open Source, self-hosted, 100+ Anbieter) für engineering-getriebene Teams; Portkey für gemanagte Guardrails und semantisches Caching; OpenRouter, wenn Sie eine Rechnung über viele Modellanbieter hinweg wollen. Details in unseren Tool-Reviews.


---
Canonical: https://cutmyaispend.com/de/methods/llm-gateways
All methods: https://cutmyaispend.com/de | JSON: https://cutmyaispend.com/api/methods.json