Chaque semaine, quelqu'un m'écrit avec la même question, formulée de dix façons différentes : « Ça coûte combien, GPT-5, en francs ? » Et à chaque fois je refais le même calcul sur un coin de table, avec le taux du jour, la grille d'OpenAI en dollars, et une estimation du nombre de tokens.
Cet article, c'est ce calcul, fait une bonne fois pour toutes. Tous les prix ci-dessous sont en FCFA. Pas en dollars, pas « à partir de », pas « contactez-nous ». Des francs.
Je le mets à jour à chaque changement de tarif chez un fournisseur. La date en haut de page fait foi.
Comment lire les chiffres
Deux conventions, et ensuite on ne les répète plus.
Le taux de change. Le franc CFA est arrimé à l'euro, donc le prix d'un dollar en francs bouge avec la parité euro-dollar. J'utilise un taux indicatif de 600 F pour 1 $ dans toutes les colonnes « direct ». Si le dollar est à 580 ou 620 le jour où tu lis, décale mentalement de 3 %. Ça ne change rien aux ordres de grandeur.
Les crédits Tchavi. Sur Tchavi tu recharges des crédits en mobile money à partir de 1 000 F, et chaque appel API en consomme. 3 000 F donnent 9 000 crédits, quel que soit le montant rechargé. Donc 1 crédit vaut 0,33 F, sans dégressivité cachée. Tous les montants « Tchavi » de cet article sont calculés à ce taux.
Un détail qui compte : la facturation des modèles de texte se fait au token près, au millième de crédit, sans minimum par requête. Une question de 80 tokens qui reçoit une réponse de 120 tokens est facturée pour 80 + 120 tokens, pas pour 1 000 + 1 000 comme c'était le cas avant octobre 2026. Ça change tout pour les chatbots, où les messages sont courts, et j'y reviens dans la partie budget.
Prix des modèles de texte en FCFA : GPT-5, Claude, DeepSeek, Gemini
C'est la catégorie où tout le monde regarde, et où les écarts sont les plus grands. Un million de tokens, c'est grosso modo 500 000 mots en français, dans les 1 000 pages de texte. Personne ne consomme ça en un appel. Mais c'est l'unité dans laquelle tout le monde publie ses prix, donc on la garde pour comparer.
Dans les trois colonnes de droite, le premier chiffre est l'entrée, le second la sortie.
| Modèle | Crédits / 1K | Tchavi, F / 1M | Direct, F / 1M |
|---|---|---|---|
| GPT-5 Nano | 0,12 · 1 | 40 · 333 | 30 · 240 |
| GPT-4o Mini | 0,36 · 1,44 | 120 · 480 | 90 · 360 |
| Mistral Small 4 | 0,36 · 1,44 | 120 · 480 | 90 · 360 |
| Llama 3.3 70B | 0,24 · 0,77 | 80 · 256 | 60 · 192 |
| DeepSeek V4 Flash | 0,72 · 3 | 240 · 1 000 | 180 · 720 |
| Gemini 3.1 Flash Lite | 0,6 · 3,6 | 200 · 1 200 | 150 · 900 |
| GPT-5 Mini | 0,6 · 5 | 200 · 1 667 | 150 · 1 200 |
| Kimi K2.5 | 1 · 5 | 333 · 1 667 | 270 · 1 350 |
| Mistral Large 3 | 1,2 · 3,6 | 400 · 1 200 | 300 · 900 |
| Claude Haiku 4.5 | 2,4 · 12 | 800 · 4 000 | 600 · 3 000 |
| DeepSeek V4 Pro | 3 · 10 | 1 000 · 3 333 | 792 · 2 376 |
| GPT-5 | 3 · 24 | 1 000 · 8 000 | 750 · 6 000 |
| Grok 4.6 | 5 · 15 | 1 667 · 5 000 | 1 200 · 3 600 |
| Gemini 3.1 Pro | 5 · 29 | 1 667 · 9 667 | 1 200 · 7 200 |
| GPT-5.4 | 6 · 36 | 2 000 · 12 000 | 1 500 · 9 000 |
| Claude Sonnet 4.6 | 7 · 36 | 2 333 · 12 000 | 1 800 · 9 000 |
| Claude Opus 5 | 12 · 60 | 4 000 · 20 000 | 3 000 · 15 000 |
La sortie coûte jusqu'à huit fois plus cher que l'entrée sur les gros modèles, et jamais moins cher, chez personne. Un modèle qui répond en trois paragraphes quand une phrase suffisait te coûte trois fois plus. Un bon system prompt qui impose des réponses courtes est la première optimisation de coût, avant même le choix du modèle.
Entre la première et la dernière ligne, il y a un facteur 100 en entrée et 60 en sortie. GPT-5 Nano et Claude Opus 5 ne jouent pas dans la même cour, ni en qualité, ni en prix. La plupart des produits que je vois passer utilisent un modèle trop gros pour ce qu'ils font. Classer un message client en « commande », « réclamation », « question » n'a pas besoin de Sonnet.
Et puis il y a la colonne de droite. Tchavi est plus cher que le direct. Autant que tu l'apprennes de moi.
Sur toute la grille, tu paies un tiers de plus que le tarif fournisseur : la marge de Tchavi est fixée à 25 % du prix, sur chaque modèle, du plus petit au plus gros. Sur Claude Sonnet 4.6 ça fait 30 % de plus en entrée, sur GPT-5 Nano 33 %. Il n'y a plus de plancher d'un crédit par millier de tokens : depuis octobre 2026, les taux sont fractionnaires et un modèle à 30 F le million en direct se vend 40 F, pas 333.
Ce surcoût te paie l'Orange Money, le MTN MoMo, un seul compte pour tous les fournisseurs, zéro frais de change, zéro carte refusée. J'ai détaillé le compromis dans l'article sur le paiement sans carte Visa. Si tu as une carte internationale qui marche et un seul fournisseur, va en direct.
Génération d'images : prix par image
Ici on paie à l'image, pas au token. Le prix dépend du modèle et de la résolution, parfois d'un niveau de qualité.
| Modèle | Crédits / image | Tchavi, F / image | Direct, F / image |
|---|---|---|---|
| GPT Image 1 Mini (low) | 11 | 4 | 3 |
| GPT Image 2 (low) | 13 | 4 | 4 |
| GPT Image 1 Mini (medium) | 24 | 8 | 7 |
| FLUX.2 Pro | 65 | 22 | 18 |
| Nano Banana Flash-Lite (1K) | 72 | 24 | 20 |
| Nano Banana (1K) | 83 | 28 | 23 |
| Seedream 4.5 | 85 | 28 | 24 |
| Seedream 5.0 Pro (1K) | 96 | 32 | 27 |
| GPT Image 2 (medium) | 113 | 38 | 32 |
| FLUX.2 Flex | 130 | 43 | 37 |
| Nano Banana 2 (1K) | 142 | 47 | 40 |
| Seedream 5.0 Pro (2K) | 191 | 64 | 54 |
| Nano Banana 2 (2K) | 214 | 71 | 61 |
| Nano Banana Pro (1K ou 2K) | 284 | 95 | 80 |
| GPT Image 2 (high) | 447 | 149 | 127 |
| Nano Banana Pro (4K) | 576 | 192 | 144 |
Pour situer : une image produit correcte en 1K coûte entre 4 F et 95 F selon le modèle, la plupart sous 50 F. Un shooting photo à Dakar ou Abidjan pour une dizaine d'articles, c'est 50 000 F minimum. L'IA n'a pas encore le rendu d'un vrai photographe sur du textile ou des bijoux, mais pour une fiche Jumia ou Afrikrea, ou une story Instagram, la différence de prix est de trois ordres de grandeur.
Itère sur tes prompts avec GPT Image 1 Mini en « low », ou FLUX.2 Pro. À 4 F ou 22 F l'essai, tu peux en rater cinquante avant de trouver l'angle. Nano Banana 2 et Nano Banana Pro, tu les sors pour la version finale, celle que le vendeur met en ligne.
Audio : transcription et synthèse vocale
| Modèle | Unité | Crédits | Tchavi, F | Direct, F |
|---|---|---|---|---|
| Whisper | 1 minute d'audio | 13 | 4,3 | 3,6 |
| TTS Standard | 1 000 caractères | 32 | 10,7 | 9 |
| TTS Mini (steerable) | 1 000 caractères | 44 | 14,7 | 10,8 |
| TTS HD | 1 000 caractères | 64 | 21,3 | 18 |
Une heure de réunion transcrite avec Whisper coûte 780 crédits, soit 260 F. Une page de texte lue à voix haute (environ 3 000 caractères) coûte 32 F en TTS Standard. Personne ne parle de ces prix-là. Pourtant ce sont les plus intéressants pour nos marchés. Une app qui accepte des vocaux en français ou en wolof et répond en vocal est devenue viable économiquement. Il y a trois ans, non.
Vidéo : prix par seconde générée
La vidéo est facturée à la seconde de sortie, avec un tarif qui dépend de la résolution et, pour certains modèles, de la présence d'une bande-son générée.
| Modèle | Résolution | Crédits / s (sans · avec audio) | Tchavi, F / s (sans · avec audio) |
|---|---|---|---|
| Veo 3.1 Lite | 720p | 72 · 120 | 24 · 40 |
| Seedance 2.0 Fast | 480p | 180 | 60 |
| Veo 3.1 Fast | 720p | 192 · 240 | 64 · 80 |
| Wan 2.6 | 720p | 240 | 80 |
| Hailuo 3 | 2K | 276 (audio inclus) | 92 |
| Kling V3 | 720p | 378 · 567 | 126 · 189 |
| Kling V3 | 1080p | 504 · 756 | 168 · 252 |
| Veo 3.1 | 720p / 1080p | 480 · 960 | 160 · 320 |
Concrètement, un clip de 8 secondes en 720p avec son :
- Veo 3.1 Lite : 960 crédits, 320 F
- Kling V3 : 4 536 crédits, 1 512 F
- Veo 3.1 : 7 680 crédits, 2 560 F
Une pub TikTok de 15 secondes avec Kling V3 en 1080p et audio revient à 11 340 crédits, donc 3 780 F. Avant de crier au scandale, compare avec le devis d'un motion designer pour la même chose.
Pas de colonne « direct » sur la vidéo. La plupart de ces modèles ne sont pas accessibles en direct depuis l'Afrique francophone, il faut passer par une plateforme intermédiaire qui prend elle aussi sa marge. La comparaison honnête serait avec Replicate ou fal.ai, et leurs prix bougent presque chaque mois. La page de chaque modèle affiche le tarif du moment.
Trois budgets réels, en FCFA
Un tableau ne paie aucune facture. Ce qui suit, c'est ton projet à toi, chiffré. Voici trois cas que je vois revenir en boucle, calculés avec les règles de facturation réelles, au token près.
Budget 1 : un chatbot WhatsApp de service client
Un message client typique fait 30 à 80 tokens. Avec le system prompt et les cinq derniers échanges de la conversation, l'entrée monte à 400 ou 600 tokens. La réponse fait 100 à 200 tokens. Prenons 500 tokens en entrée et 150 en sortie, facturés au token près.
| Modèle | Coût par message | 100 msgs / jour | 1 000 msgs / jour |
|---|---|---|---|
| GPT-5 Nano | 0,21 crédit, 0,07 F | 210 F / mois | 2 100 F / mois |
| DeepSeek V4 Flash | 0,81 crédit, 0,27 F | 810 F / mois | 8 100 F / mois |
| GPT-5 Mini | 1,05 crédit, 0,35 F | 1 050 F / mois | 10 500 F / mois |
| Claude Haiku 4.5 | 3 crédits, 1,00 F | 3 000 F / mois | 30 000 F / mois |
| Claude Sonnet 4.6 | 8,9 crédits, 2,97 F | 8 900 F / mois | 89 000 F / mois |
Une boutique qui reçoit 100 messages par jour tourne sur GPT-5 Mini pour 1 050 F d'API par mois, moins qu'un forfait téléphone. Sonnet, au même volume, mange 8 900 F. Le bon réglage, c'est GPT-5 Mini ou Haiku par défaut, et Sonnet uniquement quand une conversation devient compliquée. J'ai écrit un guide complet pour construire ce bot, avec le code.
Budget 2 : un catalogue produit pour vendeurs e-commerce
Un vendeur uploade une photo brute, tu la mets en scène (fond propre, lumière studio). Supposons 50 images par jour, soit 1 500 par mois.
| Modèle | Coût par image | 1 500 images / mois |
|---|---|---|
| GPT Image 1 Mini (low) | 4 F | 5 500 F |
| FLUX.2 Pro | 22 F | 32 500 F |
| Nano Banana (1K) | 28 F | 41 500 F |
| Nano Banana 2 (1K) | 47 F | 71 000 F |
Les totaux sont calculés en crédits puis convertis, d'où le petit écart si tu multiplies simplement la colonne de gauche par 1 500.
Si tu factures 200 F l'image au vendeur, ta marge brute sur Nano Banana est de 86 %. Sur FLUX.2 Pro elle est de 89 %. L'API n'est pas ton problème sur ce produit. Trouver les vendeurs, si.
Budget 3 : une app vocale pour utilisateurs non-lettrés
L'utilisateur envoie un message vocal de 30 secondes, tu le transcris, un modèle de texte répond, tu renvoies la réponse en vocal. Pour 100 messages par jour :
| Étape | Modèle | Coût par message | Par mois (3 000 msgs) |
|---|---|---|---|
| Transcription (30 s, facturée 1 min) | Whisper | 13 cr, 4,33 F | 13 000 F |
| Réponse texte | GPT-5 Mini | 1,05 cr, 0,35 F | 1 050 F |
| Synthèse vocale (400 car.) | TTS Standard | 12,8 cr, 4,27 F | 12 800 F |
| Total | 9 F | 27 000 F |
L'intelligence ne coûte presque rien ; c'est l'audio, dans les deux sens, qui fait la facture. Deux leviers : ne pas vocaliser les réponses longues (envoie du texte au-delà de 300 caractères) et utiliser TTS Standard plutôt que HD, la différence est inaudible sur un haut-parleur de téléphone. La transcription, elle, se facture à la minute entamée, donc un vocal de 30 secondes coûte autant qu'un vocal d'une minute.
Les recharges, et ce qu'elles débloquent
| Montant | Crédits | Niveau atteint avec cette seule recharge |
|---|---|---|
| 3 000 F | 9 000 | Builder : 30 req/min, 3 clés API |
| 10 000 F | 30 000 | Growth : 120 req/min, 10 clés API |
| 30 000 F | 90 000 | Growth : 120 req/min, 10 clés API |
Le niveau Pro (300 req/min, clés illimitées) s'ouvre à 50 000 F rechargés au total. Il faut donc recharger à deux reprises.
Ta première recharge ajoute 150 crédits bonus. Les crédits achetés n'expirent pas. Les niveaux de compte se cumulent sur le montant total rechargé, pas sur un abonnement : tu passes Growth à 10 000 F cumulés, quel que soit le découpage de tes recharges.
Il n'y a pas de carte bancaire demandée, à aucun moment. La recharge se fait en mobile money — la liste complète des opérateurs et pays pris en charge est publiée en temps réel sur /api/payments/providers — et les crédits sont sur le compte en moins d'une minute.
Ce que ce tableau ne dit pas
Les grosses factures que j'ai vues passer ne venaient jamais du prix affiché. Elles venaient d'ici.
L'historique de conversation. Si tu renvoies les 30 derniers messages à chaque appel, ton entrée passe de 500 à 5 000 tokens. Cinq tranches facturées au lieu d'une, à chaque message. Garde les cinq à dix derniers échanges, résume le reste.
Les boucles d'agents. Un agent qui appelle un outil, relit le résultat, rappelle un outil, peut faire 15 appels API pour une seule question utilisateur. Sur Sonnet, ça fait une cinquantaine de francs la question au bas mot, souvent bien plus parce que chaque appel embarque le contexte des précédents. Mets un plafond d'itérations.
Le retry aveugle. Un retry sur un timeout côté client alors que le fournisseur a bien traité la requête, c'est une réponse payée deux fois. L'en-tête X-Credits-Used sur chaque réponse Tchavi te dit exactement ce qui a été facturé, logge-le.
Ce que je ferais à ta place
Le choix du modèle pèse dix fois plus sur ta facture que le choix du fournisseur. Passer de Sonnet à GPT-5 Mini divise le coût d'un chatbot par huit. Quitter Tchavi pour le direct t'en économise un quart. Commence par le modèle.
Et si tu veux tester ces chiffres sur ton propre cas, crée un compte, recharge 3 000 F en mobile money, et regarde l'en-tête X-Credits-Used de tes premiers appels. C'est plus fiable que n'importe quel tableau, le mien compris.
FAQ
Combien coûte GPT-5 en FCFA ? Chez Tchavi, 1 000 F le million de tokens en entrée et 8 000 F le million en sortie, soit 3 et 24 crédits par millier de tokens, facturés au token près. En direct chez OpenAI, au taux de 600 F pour 1 $, c'est 750 F et 6 000 F. GPT-5 Mini fait le même travail pour un cinquième du prix sur la plupart des usages.
Le taux de 600 F pour 1 $ est-il celui appliqué par Tchavi ? Non. Tchavi ne convertit pas de dollars : les crédits sont vendus en FCFA à un prix fixe, 3 000 F les 9 000 crédits. Le taux de 600 F sert uniquement à convertir les grilles des fournisseurs en dollars pour la colonne « direct » du comparatif.
Y a-t-il un minimum par requête ? Non. Chaque requête est facturée au token près, au millième de crédit, l'entrée et la sortie chacune à son taux. Un message court sur GPT-5 Nano (500 tokens en entrée, 150 en sortie) coûte 0,21 crédit, soit 0,07 F. Le détail est dans la documentation sur les crédits.
Les prix en direct changent souvent, comment est-ce que tu maintiens ce tableau ? Les prix Tchavi sont recalculés quand un fournisseur change sa grille, et la date en haut de l'article est mise à jour à chaque révision. Pour un modèle précis, la page du modèle est toujours plus à jour que cet article.
Est-ce qu'il y a un tarif dégressif pour les gros volumes ? Non : le taux est le même à 1 000 F et à 30 000 F. Au-delà de quelques centaines de milliers de francs par mois, écris à support@tchavi.com.
Quel modèle choisir pour démarrer ? GPT-5 Mini pour du texte généraliste. DeepSeek V4 Flash si ton budget est serré et que son français passe pour ton usage. Claude Haiku 4.5 si tu veux un ton plus naturel. Sonnet ou GPT-5, seulement quand tu as mesuré que le petit modèle échoue sur des cas précis.
Cet article fait partie de la série « Construire un SaaS IA depuis l'Afrique francophone ». Le précédent : payer OpenAI, Claude et Mistral sans carte Visa. Pour suivre les prochains, Tchavi est sur LinkedIn.