Aller au contenu principal
Automatisation Budget PME Stratégie IA

Combien coûte une automatisation IA : les quatre postes d'un devis

Un devis d'automatisation tient en quatre postes. La plupart n'en montrent qu'un ou deux, et la ligne manquante se découvre six mois plus tard. Voici la grille pour lire le vôtre.

Geoffrey Pigot · · 8 min de lecture
Combien coûte une automatisation IA : les quatre postes d'un devis

Un devis d’automatisation IA tient en quatre postes. La plupart n’en montrent qu’un ou deux. Cet article vous donne les quatre, ce qui fait exploser chacun d’eux, et la question à poser pour chacun.

Ce n’est pas un guide de négociation. C’est un test de conseil : à la fin, vous saurez si la personne en face a réfléchi à votre place ou si elle vous a transmis une addition.

Commencez par la ligne manquante

Ouvrez votre dernier devis d’automatisation. Cherchez le mot maintenance.

S’il n’y figure pas, vous ne connaissez pas le prix de votre projet. Vous connaissez son prix d’achat. Ce sont deux chiffres différents, et l’écart entre les deux se découvre en général six mois plus tard.

Précision utile : ce n’est pas à vous de savoir. Un dirigeant n’a aucune raison de connaître le prix d’un million de tokens, ni la différence entre deux modèles. Celui qui vous chiffre, si. La question n’est donc pas de savoir si vous avez bien négocié, c’est de savoir si on vous a expliqué qu’il y avait un choix à faire.

Ce que font les entreprises quand quelqu’un arbitre

Le 23 août 2026, le Financial Times a publié les données de Ramp, qui suit la consommation de tokens de 70 000 entreprises. Résultat : Fable 5, le modèle haut de gamme d’Anthropic, ne représente que 6 % des tokens achetés chez son éditeur et 11,4 % des dépenses, deux mois après sa mise à disposition. Le modèle le plus performant du marché n’est pas celui que les entreprises achètent.

Même direction ailleurs. Selon l’index de production de Vercel publié le 11 août 2026, la part des modèles à poids ouverts est passée d’environ 11 % du volume en avril 2026 à 36 % en juillet.

Ces entreprises n’ont pas mieux négocié. Elles ont quelqu’un qui choisit le modèle tâche par tâche. C’est toute la différence, et elle ne s’obtient pas en demandant une remise.

Ce n’est pas une baisse de prix, et c’est important. Anthropic n’a pas divisé ses tarifs par deux. L’éditeur a mis un modèle moins cher à côté du plus cher : Claude Opus 5 est affiché à 5 dollars le million de tokens en entrée et 25 en sortie, contre 10 et 50 pour Fable 5. C’est un écart entre deux produits du catalogue au même instant, pas une baisse dans le temps. Si vous payiez déjà le milieu de gamme, rien n’a changé pour vous.

Un ordre de grandeur à garder en tête

Un million de tokens en sortie représente, en français, quelque chose comme cinq à sept cent mille mots. C’est un ordre de grandeur, pas une mesure : le ratio varie avec la langue et le contenu.

Autrement dit, 25 dollars pour produire l’équivalent de plusieurs milliers de pages. Comparez cette ligne à une seule journée de prestation dans le même devis.

Vous venez de comprendre deux choses. Que le tarif du modèle est rarement là où se joue votre budget. Et qu’un prestataire qui ne vous parle que de ça ne vous parle pas de votre projet.

Les quatre postes

Remplissez cette grille avec vos propres chiffres, ou faites-la remplir par votre prestataire. Un devis qui ne se décompose pas en ces quatre lignes est un devis que vous ne pouvez comparer à rien.

PosteComment il se chiffreCe qui le fait exploserLa question à poser
1. Cadrage et conceptionJours × taux journalierUn périmètre qui bouge, une tâche mal décrite au départ, trois interlocuteurs qui n’ont pas la même définition du résultat attendu.Combien de jours, et qu’est-ce que je reçois à la fin de cette phase, même si j’arrête là ?
2. Intégration et développementJours × taux journalierLe nombre de systèmes à raccorder, et surtout ceux qui n’ont pas d’API. Un export manuel dans la chaîne et le coût double.Quels systèmes sont raccordés automatiquement, et lesquels supposent encore une manipulation humaine ?
3. Consommation de modèlesVolume mensuel × tarif, après mise en cacheUn modèle premium utilisé partout au lieu d’être réservé aux cas rares et coûteux à rater.Quel modèle pour quelle tâche, et pourquoi celui-là plutôt qu’un moins cher ?
4. Maintenance et reprisesHeures par mois × coût horaire, sur douze moisLe poste oublié de tous les devis. Un fournisseur change son API et la chaîne s’arrête. Personne en interne ne sait la réparer.Qui répare quand ça casse, en combien de temps, et à quel tarif après la garantie ?

Le test en une ligne. Additionnez les postes 1, 2 et 4 sur douze mois, puis comparez au poste 3. Si le poste 3 dépasse le quart du total, votre projet consomme beaucoup de modèle et le chapitre suivant vous concerne directement. S’il représente quelques pour cent, cessez de regarder cette ligne et demandez le détail des trois autres : c’est là qu’est votre argent.

Les trois arbitrages qu’un bon prestataire a déjà tranchés

Ces trois questions ne servent pas à faire baisser un prix. Elles servent à savoir si la personne en face a réfléchi à votre place.

Quel modèle pour quelle tâche ? Trier une boîte mail, extraire les lignes d’une facture, rédiger une première relance : ces tâches tournent sur du milieu de gamme, parfois sur des modèles ouverts. Le premium se justifie là où l’erreur coûte cher et se voit tard, un contrat, une réponse à appel d’offres, un diagnostic. C’est exactement l’arbitrage que font les 70 000 entreprises suivies par Ramp.

Ce qui est répété est-il mis en cache ? Anthropic annonce sur sa page produit jusqu’à 90 % d’économie via la mise en cache des invites, et 50 % via le traitement par lots. Une automatisation qui repasse le même corpus à chaque exécution, votre catalogue, vos procédures, votre base clients, coûte donc bien moins que le calcul naïf « volume × tarif affiché ».

Ce qui n’est pas urgent peut-il partir en lot ? Une relance de facture n’a pas besoin de répondre en deux secondes. Un traitement groupé la nuit coûte moitié moins et ne change rien pour personne.

Si votre interlocuteur n’a tranché aucune de ces trois questions, le problème de votre devis n’est pas son prix. Posez-lui la question simple : on m’a expliqué le choix, ou on m’a donné un prix ?

Ce que cet article ne dit pas

Un projet mal cadré reste un projet mal cadré à moitié prix. Aucun tarif de modèle ne rattrape une tâche qu’il ne fallait pas automatiser.

Et un coût n’est pas un retour sur investissement. Savoir ce que quelque chose coûte ne dit pas ce qu’il rapporte : ça se mesure sur la tâche, avant et après, pas sur une grille tarifaire.

Pour qui cet article n’est pas fait

Si vous n’avez aucun devis d’automatisation en cours ni en projet, il ne vous servira pas : c’est un outil de comparaison, il faut quelque chose à comparer. Si vous cherchez à choisir entre deux fournisseurs de modèles, ce n’est pas la question traitée ici. Et si votre sujet est de savoir quoi automatiser en premier, c’est un autre travail, antérieur à celui-ci.

Si vous avez un devis sur le bureau et que la grille des quatre postes ne se remplit pas, envoyez-le moi : on la remplit ensemble et je vous dis où je vois le coût réel. Si le projet ne tient pas la route, je vous le dis pendant l’appel.

Sources et méthode

  • Données Ramp (AI Token Spend Management, 70 000 entreprises) publiées par le Financial Times le 23 août 2026 : Fable 5 à 6 % des tokens et 11,4 % des dépenses chez Anthropic.
  • Anthropic, page produit Claude Opus : 5 et 25 dollars le million de tokens pour Opus 5, jusqu’à 90 % d’économie via la mise en cache des invites, 50 % via le traitement par lots.
  • Vercel AI Gateway Production Index, publication du 11 août 2026 : modèles à poids ouverts à 36 % du volume en juillet 2026, contre environ 11 % en avril.

Deux réserves à porter avec ces chiffres. L’échantillon Ramp penche vers les entreprises technologiques américaines et ne représente pas le tissu des PME françaises. Et une lecture circule selon laquelle Anthropic s’effondrerait : c’est faux, l’éditeur conserve 65,1 % des dépenses sur la passerelle Vercel pour 30 % des tokens. Ce qui se déplace, c’est l’arbitrage prix contre performance, pas la position d’un acteur.

Les ordres de grandeur mots et tokens, ainsi que la grille des quatre postes, sont des outils de travail. Ils n’ont pas de valeur statistique et n’en revendiquent aucune. Les tarifs de modèles évoluent vite : ceux cités ici ont été relevés le 24 août 2026 et sont à revérifier avant tout arbitrage budgétaire.

Prendre RDV