Journal du Passeur · entrée n° 11 · 3 août 2026

Combien coûte un agent IA ? Prix vérifiés et grille de lecture

Prix publics des modèles OpenAI et Anthropic (août 2026), scénario de calcul, et grille en cinq blocs pour lire un devis d’agent IA.

Sur la page tarifaire de l’API OpenAI (consultée le 3 août 2026), en mode Standard et contexte court, les prix par million de tokens vont de 0,20 $ en entrée / 1,20 $ en sortie (gpt-5.6-luna) à 5 $ / 30 $ (gpt-5.6-sol) ; gpt-5.6-terra est à 2 $ / 12 $, gpt-5.4 à 2,50 $ / 15 $. Sur la page tarifaire d’Anthropic (consultée le 3 août 2026), Haiku 4.5 est à 1 $ / 5 $ par million de tokens, Sonnet 5 à 2 $ / 10 $ jusqu’au 31 août 2026 puis 3 $ / 15 $, Opus 5 à 5 $ / 25 $, Fable 5 à 10 $ / 50 $. Ces montants ne couvrent que l’appel au modèle. Construction, exploitation et évolution se lisent dans le devis, via la grille en cinq blocs ci-dessous.

Schémas de systèmes connectés disposés sur un bureau

Ces tarifs sont en dollars US, par million de tokens ; ils évoluent, d’où le renvoi aux pages vivantes. Un même projet peut facturer la construction (livraison du système), l’usage fournisseur (tokens et services tiers), l’exploitation (suivi, incidents) et l’évolution (changements de workflow ou de connexions). Ces objets de dépense ne se confondent pas avec les cinq blocs de contenu du devis.

Combien coûte l’usage d’un modèle en pratique ?

Prenons un scénario hypothétique : un agent qui traite 100 demandes par jour, chaque demande consommant 8 000 tokens en entrée et 1 000 tokens en sortie, pendant 30 jours, soit 24 millions de tokens d’entrée et 3 millions de tokens de sortie par mois. Le calcul porte uniquement sur l’appel au modèle, aux tarifs publics indiqués ci-dessus. Hypothèses supplémentaires : tous les tokens d’entrée sont facturés au tarif d’entrée non mise en cache ; aucun traitement par lot (batch), mode accéléré, majoration régionale, outil, recherche ou temps d’exécution n’est inclus ; le calcul n’utilise que les tarifs d’entrée et de sortie affichés, en dollars US.

ModèleTarif retenu (par million de tokens)CalculCoût mensuel du seul appel modèle
gpt-5.6-luna0,20 $ entrée / 1,20 $ sortie (page tarifaire de l’API OpenAI, consultée le 3 août 2026)24 × 0,20 + 3 × 1,208,40 $
Sonnet 5 (tarif de lancement)2 $ entrée / 10 $ sortie jusqu’au 31 août 2026 (page tarifaire d’Anthropic, consultée le 3 août 2026)24 × 2 + 3 × 1078 $
gpt-5.6-sol5 $ entrée / 30 $ sortie (page tarifaire de l’API OpenAI, consultée le 3 août 2026)24 × 5 + 3 × 30210 $

À volume identique, le choix du modèle fait varier ce poste d’un facteur 25 dans ce scénario (8,40 $ contre 210 $). Ces montants ne couvrent ni la construction, ni l’exploitation, ni l’évolution. Le volume réel de tokens dépend du workflow et ne se devine pas : ce scénario est une illustration arithmétique, pas un cas client ni une moyenne.

Second scénario hypothétique, mêmes hypothèses supplémentaires : un agent qui traite 20 demandes par jour, chaque demande consommant 2 000 tokens en entrée et 500 tokens en sortie, pendant 30 jours, soit 1,2 million de tokens d’entrée et 0,3 million de tokens de sortie par mois.

ModèleTarif retenu (par million de tokens)CalculCoût mensuel du seul appel modèle
Haiku 4.51 $ entrée / 5 $ sortie (page tarifaire d’Anthropic, consultée le 3 août 2026)1,2 × 1 + 0,3 × 52,70 $ par mois
gpt-5.42,50 $ entrée / 15 $ sortie (page tarifaire de l’API OpenAI, consultée le 3 août 2026)1,2 × 2,50 + 0,3 × 157,50 $ par mois
Opus 55 $ entrée / 25 $ sortie (page tarifaire d’Anthropic, consultée le 3 août 2026)1,2 × 5 + 0,3 × 2513,50 $ par mois

Ces trois montants illustrent l’arithmétique à un volume plus bas ; ils ne constituent ni une moyenne, ni un cas typique, ni un ordre de grandeur représentatif.

Pour situer les prix hors de ces calculs, Sonnet 5 passe à 3 $ / 15 $ après le 31 août 2026 (page tarifaire d’Anthropic, consultée le 3 août 2026) ; gpt-5.6-terra est à 2 $ / 12 $ par million de tokens (page tarifaire de l’API OpenAI, consultée le 3 août 2026). Les mêmes pages publient des tarifs réduits hors de ces hypothèses : l’entrée mise en cache est à 0,02 $ par million de tokens pour gpt-5.6-luna et 0,50 $ pour gpt-5.6-sol (page tarifaire de l’API OpenAI, consultée le 3 août 2026) ; la lecture de cache est à 0,10 $ par million pour Haiku 4.5 et 0,50 $ pour Opus 5, et la page annonce « Save 50% with batch processing » (page tarifaire d’Anthropic, consultée le 3 août 2026).

Quels postes composent un devis ?

OpenAI décrit les agents comme des applications qui planifient, appellent des outils, collaborent entre spécialistes et conservent un état pour mener un travail en plusieurs étapes (documentation OpenAI sur les agents, consultée le 3 août 2026). Différents spécialistes peuvent nécessiter des instructions, des outils ou des politiques distincts (même page, consultée le 3 août 2026). Le coût d’un tel système ne se réduit donc pas à une ligne « modèle ».

La grille proposée comporte cinq blocs. Elle n’est ni une norme ni une classification officielle : c’est un outil de lecture pour rendre des offres comparables. Le modèle, les instructions et les données sont des sous-éléments de ces blocs, pas des postes supplémentaires.

Bloc principalSous-éléments inclusCe que le devis doit préciserQuestion de contrôle
PérimètreWorkflow, modèle et instructionsEntrée, sortie attendue, actions autorisées, exclusions, cas d’escalade, rôle du modèle et méthode de modification des instructionsQuelle tâche exacte est confiée à l’agent et où s’arrête-t-elle ?
IntégrationsOutils connectés et données échangéesApplications, comptes, droits, environnements, dépendances tierces, données lues, écrites ou transmises et comportement en cas d’échecQue peut lire ou modifier chaque connexion ?
ContrôleTests, validation humaine et règles appliquées aux donnéesCas de test, limites d’action, validation, accès aux données, conservation, traces utiles à la revue et procédure d’incidentQui autorise une action qui engage le processus ?
ExploitationObservation, alertes, incidents et changementsResponsable de chaque intervention, exclusions du service et traitement des défaillancesQue se passe-t-il lorsqu’un résultat est refusé ou qu’un outil échoue ?
PropriétéCode, instructions, configurations, comptes, documentation et restitutionÉléments remis, modalités d’accès, export, suppression et fin de la relationQue récupère l’acheteur à la fin du projet ou du service ?

Périmètre. « Répondre aux demandes » ne constitue pas un périmètre vérifiable. L’offre indique d’où vient la demande, les informations permises, la sortie attendue et la limite d’action : une réponse préparée pour validation et un envoi autonome sont deux niveaux distincts. Le modèle et les instructions appartiennent à ce bloc ; leur description précise leur rôle, leurs limites et le mode de mise à jour. Ces questions aident à passer du besoin au workflow dans une démarche de création d’un agent IA.

Intégrations. Chaque connexion est nommée : application, action permise, compte, environnement, tiers, et réponse prévue en cas d’échec. Les données sont un sous-élément de la connexion (ce qui entre, ce qui sort, l’usage). Une ligne générique « intégration » ne doit pas masquer plusieurs accès.

Choisir la bonne porte

Contrôle. Ce bloc porte sur les preuves et les décisions qui encadrent le système : cas de test, validation humaine, limites d’action, droits d’accès, conservation, traces et procédure d’incident. Le NIST présente son AI Risk Management Framework comme un cadre volontaire visant la gestion des risques liés à l’IA au fil du cycle de vie des systèmes (NIST). Ce cadre ne valide pas cette grille de devis ; il montre l’intérêt de rendre les contrôles visibles.

Exploitation. Le devis indique qui suit l’état du système, qui reçoit les alertes, qui examine un refus et qui traite une panne. Une mention de « maintenance incluse » sans liste des interventions ni exclusions reste floue. Une correction, une évolution du workflow et l’ajout d’un outil ne sont pas le même travail : l’offre précise comment chaque cas est qualifié.

Propriété. L’inventaire peut couvrir le code, les instructions, les réglages, la documentation, les comptes, les accès, les exports et la suppression. Ce bloc distingue ce qui est remis à l’acheteur et ce qui reste chez un tiers, y compris en fin de relation. Cette liste sert à poser les questions de restitution ; elle ne remplace pas l’examen juridique du contrat.

Qu’il s’agisse d’un build sur mesure, d’une plateforme à configurer ou d’un service managé, ce sont les livrables et les responsabilités couverts dans chaque bloc qui rendent les offres comparables, pas le titre de la mission. Cette comparaison peut être replacée dans le cadre de l’intelligence artificielle en entreprise.

FAQ sur le coût d’un agent IA

Que couvrent les tarifs publics des modèles ?

Uniquement l’usage facturé par le fournisseur, en dollars US par million de tokens. Exemple : Sonnet 5 à 2 $ / 10 $ jusqu’au 31 août 2026, puis 3 $ / 15 $ (page tarifaire d’Anthropic, consultée le 3 août 2026). Construction, exploitation et évolution restent hors de ces pages.

Qui paie la consommation des API ?

Le devis précise le montage : compte acheteur, compte prestataire ou refacturation. Consulter une page tarifaire ne remplace pas la lecture de la construction dans le devis.

Une lecture commune avant la signature

Les prix publics des modèles donnent un premier ancrage chiffré ; le résultat n’est pas un prix universel, c’est un objet clair, comparable, et un poste modèle que l’on peut recalculer à partir des pages officielles.

Choisir la bonne porte