Personne n'a encore trouvé comment fixer le prix de l'IA. C'est un problème pour tout le monde
Les entreprises paient l'IA au token, une infime unité de texte que le logiciel traite, mais personne — ni les startups, ni Microsoft, ni les sociétés vendant des services d'IA — ne peut prédire combien de tokens une tâche consommera. Les budgets explosent, et la facture arrive avant que quiconque ne s'en aperçoive.

Points clés
- Goldman Sachs prévoit que la consommation externe de tokens augmentera 24 fois entre 2026 et 2030, atteignant 120 quadrillions de tokens par mois.
- Microsoft aurait réduit l'utilisation par ses ingénieurs de certains outils de codage IA tiers en raison de préoccupations relatives aux coûts.
- Uber aurait épuisé son budget annuel de tokens pour le codage IA en quelques mois en 2025.
- Un token est une petite fraction mathématique de texte qu'un modèle d'IA lit et écrit ; chaque question que vous posez et chaque réponse que vous recevez coûtent des tokens.
- Les initiés du secteur affirment qu'aucun modèle de tarification standard pour les services d'agents IA n'a émergé pour l'instant.
Utiliser ChatGPT, Claude ou Google Gemini gratuitement ressemble à obtenir quelque chose pour rien. En un sens, c'est le cas. Microsoft, Google, Anthropic et leurs concurrents ont investi des centaines de milliards de dollars dans la construction des grands modèles de langage, la technologie derrière ces chatbots, qui alimentent ces niveaux gratuits. Ils veulent récupérer cet argent.
Des plans payants existent, et les fonctionnalités premium sont verrouillées derrière eux. Mais le problème de tarification plus difficile se situe une couche plus profonde, et il crée des difficultés aux entreprises de toutes tailles.
Qu'est-ce qu'un token, et pourquoi coûte-t-il de l'argent ?
Un token est l'unité de base avec laquelle un modèle d'IA fonctionne. Pensez-le comme un petit fragment d'un mot ou d'une phrase que le modèle convertit en mathématiques, traite, puis reconvertit en texte lisible. Chaque prompt que vous tapez est décomposé en tokens. Chaque réponse que le modèle envoie coûte aussi des tokens.
Les prix des tokens ont baissé considérablement ces dernières années. Cela semble être une bonne nouvelle, et c'est en partie le cas. Le hic, comme l'a rapporté BBC Technology, est que l'utilisation a explosé en conséquence. Goldman Sachs prévoit que la consommation de tokens atteindra 120 quadrillions par mois d'ici 2030, soit 24 fois plus qu'en 2026, tirée principalement par les agents IA, des programmes logiciels qui accomplissent automatiquement des tâches en plusieurs étapes plutôt que de simplement répondre à une seule question.
Plus d'agents signifient plus de tokens. Plus de tokens signifient des factures plus élevées. Et les factures arrivent avant que la plupart des entreprises n'aient la moindre idée de ce qui les a provoquées.
Pourquoi est-ce si difficile à contrôler ?
La réponse courte : la production d'IA est imprévisible. Posez la même question deux fois et vous pouvez obtenir deux réponses différentes de longueurs différentes, consommant deux quantités différentes de tokens. Intégrez cette imprévisibilité dans un produit utilisé par des milliers de clients, et les coûts peuvent s'envoler rapidement.
Will Venters, professeur associé d'innovation numérique à la London School of Economics, le dit clairement : « C'est une production non-déterministe, donc c'est une valeur non-déterministe. »
Les petites entreprises contournent parfois ce problème en utilisant discrètement des comptes personnels à tarif forfaitaire auprès de grandes plateformes d'IA. Oliver King-Smith, fondateur du cabinet d'ingénierie smartR AI, affirme que les fournisseurs désapprouvent presque certainement cela, et que cela ne peut pas durer. Une fois que les actionnaires commencent à faire pression pour les profits, il prédique que les plateformes « commenceront à réprimer ».
Même les grandes organisations se font surprendre. Microsoft aurait réduit l'utilisation par ses ingénieurs de certains outils de codage tiers. Uber aurait épuisé son budget annuel de tokens pour le codage IA en quelques mois.
Que se passe-t-il ensuite ?
Personne n'a encore de réponse nette. Bill Peterson, directeur senior du marketing produit chez Sumo Logic, une société logicielle actuellement en avant-première de services de sécurité IA, affirme que les conversations de tarification avec les clients sont en cours. Les options en discussion incluent l'augmentation des prix sur toute la ligne, la facturation par résultat ou la vente de lots d'incidents. Mais toute structure qu'une entreprise choisit aujourd'hui peut être bouleversée au moment où un fournisseur d'IA modifie ses propres tarifs.
« Vous entrez dans une tarification variable, et elle change tous les deux mois », dit Peterson. « Les clients n'aiment pas ça. Ce n'est pas comme ça que quiconque établit un budget. »
Pour les utilisateurs ordinaires, le risque immédiat est limité : les plans gratuits et à tarif forfaitaire agissent comme un plafond. Pour les petites entreprises qui commencent à intégrer l'IA dans leurs propres produits ou flux de travail, le conseil pratique de ceux qui vivent ce problème est simple. Soyez précis avec vos demandes, comme vous le feriez en écrivant une liste d'épicerie détaillée plutôt que de simplement dire « achète quelque chose à manger ». Choisissez le plus petit modèle d'IA qui gère réellement votre tâche. Et définissez une alerte de dépenses avant d'en avoir besoin.
Questions fréquemment posées
Mon compte ChatGPT ou Gemini gratuit coûtera-t-il soudainement plus cher ?
Les niveaux gratuits sont actuellement subventionnés par les grandes plateformes en concurrence pour les utilisateurs. Ils peuvent restreindre les fonctionnalités au fil du temps, mais aucun grand fournisseur n'a annoncé de plans pour mettre fin complètement à l'accès gratuit.
Que peut faire une petite entreprise dès maintenant pour contrôler les coûts de l'IA ?
Commencez par suivre l'utilisation mensuellement, comme vous le feriez pour une facture de stockage en nuage. Écrivez des demandes détaillées pour que l'IA ne gaspille pas de tokens à deviner ce que vous voulez. Si possible, testez avec un modèle moins cher ou plus petit avant de vous engager pour un modèle plus cher.



