# Gateways LLM et outils de suivi des dépenses

> Cut My AI Spend — rank #10 of 10. Économies typiques: Couche opérationnelle qui débloque les méthodes 2 à 9. Effort: Faible — essentiellement un changement de proxy.

Une gateway (LiteLLM, Portkey, OpenRouter) vous donne une API unique pour tous les fournisseurs, plus les points de contrôle dont chaque autre méthode a besoin : caching, routage, fallbacks, budgets, limites de débit et journalisation des coûts par requête. Les couches de suivi des dépenses (Helicone — désormais en maintenance seule depuis son rachat par Mintlify — nOps, tableaux de bord natifs des fournisseurs) ajoutent la visibilité.
Seule, une gateway économise peu ; en tant que point d'application du caching, du routage et de l'attribution, c'est ce qui rend les économies systématiques plutôt que ponctuelles.

## Comment faire

1. Faites passer tout le trafic LLM par une seule gateway ; bannissez les appels directs aux SDK des fournisseurs en revue de code.
2. Activez la journalisation des requêtes avec métadonnées de coût dès le premier jour.
3. Activez les fallbacks entre fournisseurs (résilience) et les plafonds budgétaires (protection contre l'emballement).
4. Placez les politiques de caching et de routage dans la gateway plutôt que dans chaque application.

## Questions fréquentes

### Quelle gateway choisir ?

LiteLLM (open source, auto-hébergée, plus de 100 fournisseurs) pour les équipes pilotées par l'ingénierie ; Portkey pour des garde-fous managés et le caching sémantique ; OpenRouter quand vous voulez une seule facture pour de nombreux éditeurs de modèles. Voir nos tests d'outils pour les détails.


---
Canonical: https://cutmyaispend.com/fr/methods/llm-gateways
All methods: https://cutmyaispend.com/fr | JSON: https://cutmyaispend.com/api/methods.json