Combien coûte votre app IA ?

API, contexte RAG, agents multi-tours, infrastructure : calculez le vrai coût de votre projet.

1

Modèle & Volume

In: $2.5Out: $10Cache: $1.25
req/mo
2

Usage Tokens (par requête)

tokens
tokens

🔍 Contexte RAG

Total: 3 000 tokens

💰 Estimation des Coûts

Coût Total Mensuel97,75 €
Coût par requête0,0098 €
API (Inférence)97,75 €
Infrastructure0,00 €

Tokens / mois

Input (Cached)0
Input (Uncached)30 500 000
Output3 000 000

Comment utiliser ce calculateur ?

Construire une app GenAI ne se limite pas aux coûts d'API. Cet outil dévoile les coûts cachés du RAG et des workflows agentiques.

  • Modèle & Volume : Choisissez votre modèle et le trafic attendu.
  • Contexte RAG : Ajustez le nombre de chunks pour voir l'impact sur la facture.
  • Agents : Simulez les agents multi-turns — une requête utilisateur peut déclencher 5+ appels LLM !
  • Infrastructure : N'oubliez pas le coût de votre Vector Database.

Astuce : le Cache

Les modèles récents (Claude, Gemini) supportent le prompt caching. Si votre system prompt est stable, vous pouvez économiser jusqu'à 90% sur les tokens d'input. Augmentez le "Cache Hit Rate" pour simuler cet effet.