121 articles · 8 rubriques Mise à jour 20.08.2026
Outils IA 08.08.2026 7 min de lecture

Combien coûte l’API d’une IA pour un petit projet en 2026 ?

Tarifs par million de tokens, factures mensuelles pour trois projets types et les leviers qui divisent la note par trois.

Combien coûte l’API d’une IA pour un petit projet en 2026 ?
Photo : Mikhail Nilov via Pexels

En bref. Pour un petit projet — un chatbot sur un site vitrine, un script qui trie des e-mails, un générateur de fiches produit — la facture d’API tourne entre 0,50 € et 30 € par mois. Ce prix ne dépend pas du nombre d’utilisateurs mais du nombre de tokens envoyés et reçus, et le même usage peut coûter vingt fois plus cher selon le modèle retenu. Le poste de dépense qui surprend n’est presque jamais l’API : c’est l’hébergement et le temps passé à faire tourner le tout.

Vous payez des tokens, pas des requêtes

Toutes les API de modèles de langage facturent au token. Un token vaut environ quatre caractères en français, soit à peu près trois quarts de mot. Une page A4 bien remplie, disons 500 mots, pèse autour de 700 tokens. Un e-mail commercial de dix lignes, environ 150 tokens.

Deux compteurs tournent en parallèle. Les tokens d’entrée, c’est tout ce que vous envoyez au modèle : votre instruction, l’historique de la conversation, les documents que vous collez dedans. Les tokens de sortie, c’est ce que le modèle écrit. La sortie coûte systématiquement cinq à six fois plus cher que l’entrée, ce qui a une conséquence pratique immédiate : envoyer beaucoup de contexte est bon marché, faire écrire de longues réponses ne l’est pas.

Troisième point, souvent mal compris : dans une conversation, l’historique est renvoyé à chaque tour. Un échange de dix messages ne coûte pas dix fois un message, il coûte la somme des dix contextes cumulés. C’est la raison principale des factures inattendues sur les chatbots laissés en libre accès.

Les tarifs au million de tokens en août 2026

Les fournisseurs facturent en dollars. Les montants ci-dessous sont convertis en euros sur une base de 1 € pour 1,08 $, hors TVA. Vérifiez toujours la page tarifaire officielle avant de bâtir un budget : ces prix bougent plusieurs fois par an, presque toujours à la baisse à performance égale.

ModèleEntrée (€ / million de tokens)Sortie (€ / million de tokens)
Gemini 2.5 Flash-Lite0,09 €0,37 €
Mistral Small 40,14 €0,55 €
GPT-5.6 Luna0,19 €1,11 €
Mistral Large 30,46 €1,39 €
Claude Haiku 4.50,93 €4,63 €
Gemini 3.1 Pro1,85 €11,11 €
GPT-5.6 Terra1,85 €11,11 €
Claude Sonnet 52,78 €13,89 €
Claude Opus 54,63 €23,15 €
GPT-5.6 Sol4,63 €27,78 €

L’écart entre le haut et le bas du tableau est d’un facteur cinquante en entrée et de soixante-quinze en sortie. C’est le seul arbitrage qui compte vraiment pour un petit projet : la plupart des tâches simples — reformuler, classer, extraire, résumer — sont traitées correctement par les modèles de la première moitié du tableau.

Trois projets types et leur facture mensuelle

Trois cas concrets, avec des volumes réalistes pour une TPE ou un indépendant. La colonne « modèle léger » utilise Gemini 2.5 Flash-Lite, la colonne « modèle intermédiaire » utilise GPT-5.6 Terra.

ProjetVolume mensuelModèle légerModèle intermédiaire
Chatbot de FAQ sur un site vitrine500 conversations, soit 3 M tokens en entrée et 0,45 M en sortie0,44 €10,55 €
Génération de fiches produit800 fiches, soit 0,96 M en entrée et 0,48 M en sortie0,27 €7,11 €
Tri et résumé d’e-mails entrants3 000 e-mails, soit 4,5 M en entrée et 0,6 M en sortie0,63 €15,00 €

Retenez l’ordre de grandeur : sur ces volumes, un modèle léger coûte moins cher qu’un café par mois. Même en montant en gamme, on reste sous le prix d’un abonnement logiciel. L’API n’est pas le sujet budgétaire d’un petit projet. Ce qui coûte, c’est ce qu’il y a autour.

Les coûts que personne ne compte au départ

  • L’hébergement du code. Un petit serveur ou une fonction serverless : entre 0 € et 20 € par mois selon le fournisseur et le trafic. Gratuit tant que vous restez dans les paliers d’essai, facturé dès que le projet marche.
  • La base de données vectorielle, si vous faites répondre le modèle sur vos propres documents. Comptez de 0 € (solution intégrée à votre base existante) à 25 € par mois pour un service dédié.
  • Les appels ratés et les relances. Un script mal écrit qui réessaie trois fois en cas d’erreur triple la facture correspondante sans que rien ne le signale.
  • Le contexte système répété. Une instruction de 2 000 tokens renvoyée à chaque appel, sur 10 000 appels, c’est 20 millions de tokens d’entrée : c’est souvent la moitié de la facture.
  • Le temps humain. Deux à cinq jours pour un premier projet fonctionnel si vous développez vous-même, 1 500 à 5 000 € en prestation. C’est le seul poste à quatre chiffres.

Côté administratif, les principaux fournisseurs facturent depuis l’étranger. Si vous êtes assujetti en France, vous êtes en autoliquidation de TVA : pensez à renseigner votre numéro de TVA intracommunautaire dans les paramètres de facturation, sinon certains fournisseurs appliquent la TVA locale et vous ne la récupérerez pas.

Mettez un plafond de dépense dès le premier jour, avant même d’écrire une ligne de code. Tous les fournisseurs proposent une limite mensuelle et des alertes par e-mail. Un agent qui part en boucle, un formulaire laissé ouvert sans limite de débit ou une clé d’API oubliée dans un dépôt public transforment une facture de 3 € en facture de 800 €, et vous le découvrez à la fin du mois.

Cinq leviers qui divisent la facture par trois

  1. Activez le cache de contexte. Chez OpenAI comme chez Anthropic, la partie d’instruction réutilisée d’un appel à l’autre est facturée environ 10 % du tarif d’entrée. Sur un chatbot avec une longue consigne fixe, l’économie va de 40 à 70 %.
  2. Passez par l’API de traitement par lots pour tout ce qui n’est pas temps réel : 50 % de remise, en échange d’un délai de quelques heures. Idéal pour générer 800 fiches produit la nuit.
  3. Choisissez le modèle par tâche, pas par réflexe. Un modèle léger par défaut, un modèle haut de gamme uniquement quand la première réponse ne suffit pas. Cette escalade conditionnelle divise couramment la note par cinq.
  4. Limitez la longueur de sortie. Le paramètre de nombre maximal de tokens est un garde-fou budgétaire autant qu’éditorial. Demandez explicitement des réponses courtes dans l’instruction.
  5. Tronquez l’historique. Dans un chatbot, ne renvoyez que les quatre ou cinq derniers échanges plus un résumé, pas toute la conversation.

Abonnement ou API : quand basculer

Un abonnement grand public à 20 ou 25 € par mois donne accès à une interface, pas à une intégration. Tant que vous êtes seul à utiliser l’outil, en copiant-collant dans une fenêtre de discussion, l’abonnement est plus simple et souvent moins cher. L’API devient pertinente à trois conditions : vous voulez brancher le modèle sur un site ou un logiciel existant, vous traitez des volumes répétitifs, ou vous avez besoin d’un contrôle précis sur le format de sortie.

Le point de bascule pratique se situe autour de 200 à 300 traitements identiques par mois. En dessous, le temps de développement ne se rentabilise pas. Au-dessus, l’API coûte quelques euros là où le travail manuel coûte plusieurs heures.

Questions fréquentes

Faut-il payer d’avance pour utiliser une API d’IA ?

Oui, chez la plupart des fournisseurs. OpenAI, Anthropic et Mistral fonctionnent par crédits prépayés : vous chargez 5 ou 10 € et vous consommez dessus. Google facture a posteriori via un compte de facturation cloud. Il n’y a pas d’abonnement minimum ni d’engagement de durée.

Combien coûte un chatbot IA sur un site vitrine par mois ?

Entre 0,50 € et 15 € d’API pour 500 conversations mensuelles, selon le modèle. Ajoutez l’hébergement, soit 0 à 20 €. Un service clés en main tout compris se situe plutôt entre 30 et 100 € par mois, ce qui reste défendable si vous ne voulez rien développer.

Les prix des API vont-ils continuer à baisser ?

La tendance des trois dernières années est nette : à niveau de performance constant, le prix au token a été divisé par dix environ. Rien ne garantit que cela continue, mais construire un projet en supposant que le coût unitaire va augmenter est le pari le moins probable aujourd’hui.

Peut-on faire tourner un modèle sans payer de tokens ?

Oui, en hébergeant un modèle ouvert sur votre propre machine ou sur un serveur loué. Vous remplacez alors un coût variable par un coût fixe : compter 40 à 150 € par mois pour un serveur avec carte graphique, ou un investissement matériel de 1 500 à 3 000 €. Cela ne devient rentable qu’à partir de volumes très supérieurs à ceux d’un petit projet, ou si la confidentialité des données l’impose.

Mis à jour le 08.08.2026 Version .md Plus dans Outils IA →
WDesigner.fr

Votre site, livré avant le paiement.

On conçoit le site complet, vous le voyez en ligne, vous payez seulement s'il vous plaît.

Voir avant de payer →