L'IA gratuite a quand même une facture
La version courte
Le marché de l'IA traverse un moment très classique du logiciel :
Tout le monde donne des choses gratuitement.
Quelle générosité.
Google explique maintenant l'accès à Gemini avec des limites d'usage et des ressources de calcul, pas seulement avec un nombre propre de requêtes. Wired souligne qu'un même abonnement peut se comporter différemment selon que l'on fait du texte, de l'image, de la vidéo, de la recherche ou du raisonnement plus lourd.
OpenAI vient aussi de publier un guide sur la manière de piloter les investissements IA à l'ère agentique. C'est la version adulte du même sujet : quand l'IA quitte le chat pour entrer dans les workflows, la question n'est plus "est-ce qu'on peut essayer ?" mais "combien ça coûte quand cela devient une partie de l'entreprise ?"
Côté startups, le marché regorge aussi de crédits, de programmes et d'accès subventionnés. OpenAI propose un programme startups avec des crédits API. Anthropic a Claude for Startups. Google Cloud met en avant des crédits pour startups utilisables sur son infrastructure et sa pile IA.
Rien de tout cela n'est mauvais.
Les crédits gratuits sont utiles. Les expériences subventionnées sont utiles. Les limites d'usage sont plus honnêtes que l'idée selon laquelle toutes les requêtes IA coûteraient la même chose.
Mais la conclusion utile est simple :
L'IA gratuite n'est pas gratuite.
C'est une stratégie d'acquisition, une boucle d'apprentissage produit, et parfois une manière d'amener une équipe à construire autour d'un fournisseur avant d'avoir appris à mesurer la facture.
Le problème n'est pas que les entreprises d'IA fassent payer.
Évidemment qu'elles font payer.
Le problème est que la vraie facture arrive souvent après que le workflow a déjà changé.
Mise à jour : la facture devient le produit
La facture n'est plus théorique.
Le 11 août, OpenAI a indiqué que ChatGPT Ads avait été lancé au Royaume-Uni, au Mexique, au Brésil, au Japon et en Corée du Sud, après les premiers pilotes. Les ads concernent les utilisateurs Free et Go, pas Plus, Pro, Business, Enterprise ou Education. OpenAI dit que les ads n'influencent pas les réponses de ChatGPT, qu'elles sont labellisées et séparées visuellement, et que les annonceurs n'ont pas accès aux conversations, memories, historiques ou informations personnelles.
Très bien.
Mais c'est la facture.
Une semaine plus tôt, OpenAI disait faire de GPT-5.6 Luna le modèle par défaut des utilisateurs Free et Go, ajouter des chats texte illimités et proposer un bouton Think pour les questions plus difficiles, tout en gardant des limites sur les fichiers, les images et les autres outils. Le produit gratuit devient plus capable. Les parties coûteuses gardent des compteurs. La couche publicitaire s'étend. Les plans payants restent plus propres.
C'est un contrat très familier.
La version gratuite obtient plus d'accès.
La version payante obtient moins d'interruptions, plus de capacité et plus de contrôle.
La plateforme obtient de l'usage, des signaux produit, de l'inventaire publicitaire, de la pression d'upgrade et une meilleure histoire sur la démocratisation de l'accès.
Très généreux. La subvention vient de découvrir un plan média.
Les ads font entrer la confiance dans le prix
OpenAI essaie de tracer une ligne claire :
La réponse est la réponse.
L'ad est l'ad.
L'annonceur ne voit pas la conversation.
Cette ligne compte.
Mais dans un produit conversationnel, elle est plus difficile à maintenir que sur une page de résultats ou dans un feed social. Les gens utilisent ChatGPT pendant qu'ils décident : quoi acheter, où voyager, comment étudier, quel outil choisir, quel fournisseur comparer, quelle recette cuisiner, quelle question de santé poser ensuite à un vrai médecin.
Une ad à côté de ce workflow n'est pas seulement une bannière.
C'est du contexte commercial à l'intérieur d'un assistant de décision.
OpenAI dit que les ads ne sont pas éligibles près de sujets sensibles ou régulés comme la santé, la santé mentale ou la politique, et que l'entreprise construira des protections contre les scams et le ciblage trop étroit. Nécessaire. Le problème, c'est que les catégories se mélangent dans la vraie vie. Un plan repas peut devenir une question de santé. Une conversation budget peut révéler une vulnérabilité financière. Un devoir scolaire peut révéler un mineur. Une recherche voyage peut révéler une situation familiale, un revenu, une localisation ou une religion.
Le produit publicitaire ne sera pas jugé sur la page de principes.
Il sera jugé sur les cas limites.
Le niveau gratuit devient un routeur économique
La même semaine, OpenAI a aussi annoncé des sièges Premium pour ChatGPT Business : 5x plus d'usage que Standard, plus de limite de cinq heures, et un prix mensuel plus élevé. C'est la version enterprise du même compteur.
Les utilisateurs gratuits voient le contrat financé par les ads.
Les power users voient le contrat de capacité.
Les entreprises voient le contrat par type de siège.
Les développeurs voient le contrat par tokens et appels d'outils.
Tout pointe vers la même réalité produit : le pricing IA devient un routeur. Le système classe les gens selon le workload, la tolérance aux ads, le besoin de confidentialité, le besoin de capacité, le besoin d'admin, et la volonté de payer quand la tâche devient importante.
Ce n'est pas forcément mauvais.
C'est probablement la seule manière de faire tenir l'économie.
Mais cela veut dire que les builders devraient arrêter de dire "on utilise ChatGPT" comme si cela décrivait un objet stable. Quel plan ? Quel modèle ? Quels outils ? Quels quotas ? Quelles conditions de données ? Quelles ads ? Quels contrôles admin ? Quel pays ? Quel âge utilisateur ? Quelles règles sur les sujets sensibles ?
Le produit IA n'est plus seulement le modèle.
C'est la politique commerciale autour du modèle.
Mise à jour : la guerre des prix des agents se joue sur la marge par workflow
Le compteur a encore bougé.
Le 21 août, OpenAI a mis à jour son article de lancement de GPT-5.6 pour indiquer que les prix API et crédits de GPT-5.6 Sol baissaient de plus de 20% pour les trois prochains mois. Cela arrive après les baisses du 30 juillet sur Luna et Terra.
Google joue la même partie de son côté. Gemini 3.7 Flash, présenté le 13 août, est décrit comme son meilleur modèle "workhorse" pour le code et les agents, avec un prix introductif jusqu'au 31 décembre : $0.75 par million de tokens en entrée et $3.75 par million de tokens en sortie. Google dit que c'est moitié moins que le prix initial de 3.6 Flash, et relie explicitement ce rapport prix/performance au passage des agents en production. L'entreprise dit aussi que Spark, son agent personnel 24/7 dans l'app Gemini, passe sur 3.7 Flash pour l'usage des outils Workspace.
Ce n'est pas une histoire de coupon.
C'est une stratégie agentique.
Une réponse de chatbot peut être subventionnée comme un coût d'acquisition. Un workflow agentique est autre chose. Il planifie, lit, appelle des outils, recommence, demande parfois une précision, résume, puis renvoie le résultat à un humain pour validation. Une seule demande utilisateur peut devenir un petit paquet d'appels modèle et d'appels d'outils.
Donc la vraie unité n'est plus "une requête".
C'est un workflow terminé.
C'est pour cela que ces baisses de prix comptent. Le modèle qui gagne n'est pas seulement le plus intelligent dans un tableau de benchmarks. C'est celui qui est assez bon, assez bon marché et assez prévisible pour rester dans un vrai processus sans transformer chaque automatisation réussie en problème de marge.
Pour les builders, le piège est clair : ne construisez pas votre modèle économique sur des prix promotionnels. Le tarif introductif de Gemini 3.7 Flash a une date de fin. La baisse de prix de Sol est explicitement temporaire. Traitez ces prix comme un signal de distribution, pas comme une base de coûts durable.
La checklist pratique change :
Mesurez le coût par workflow terminé, pas le coût par appel.
Suivez les tentatives répétées et les boucles de clarification.
Routez les étapes faciles vers des modèles moins chers quand la qualité le permet.
Ajoutez le temps de validation humaine à la facture.
Écrivez ce qui se passe quand le prix promotionnel expire.
Si la réponse est "on verra plus tard", félicitations, vous venez de trouver la vraie page de pricing.
Ce que les acheteurs doivent retenir
Pour les utilisateurs ordinaires, la leçon pratique est simple :
si un produit IA gratuit devient beaucoup meilleur, demandez ce qui le finance.
Peut-être que la réponse est la publicité.
Peut-être que c'est la conversion vers un plan payant.
Peut-être que c'est un bundle cloud.
Peut-être que c'est une subvention enterprise.
Peut-être que c'est de l'argent investisseur qui veut de l'usage maintenant et de la marge plus tard.
Pour les entreprises, la leçon est plus stricte :
ne laissez pas des employés construire des workflows importants sur un plan consumer dont l'économie, les ads, les limites et les contrôles de données ne sont pas conçus pour votre modèle de risque. Et ne supposez pas qu'un plan payant supprime tous les compteurs. Il peut simplement déplacer le compteur vers les sièges, les crédits workspace, les limites d'outils, le routage modèle ou la capacité premium.
L'IA gratuite peut rester très utile.
Elle a simplement arrêté de prétendre que la facture était imaginaire.
Les crédits sont de la distribution, pas de la charité
Dans le logiciel, "gratuit" veut souvent dire "nous sommes encore en train de décider qui capte la valeur."
Avec l'IA, ce contrat devient plus compliqué parce que l'unité marginale n'est pas seulement un siège. Elle peut être des tokens, des images, des générations vidéo, des appels d'outils, de la recherche documentaire, de la mémoire, des agents longs, des évaluations, des garanties de latence, des fonctions de conformité et du temps de relecture humaine.
C'est pour cela que les crédits comptent.
Ils permettent à une startup de tester un modèle sans surveiller chaque expérimentation au centime près. Ils peuvent aussi rendre un fournisseur par défaut au moment le plus formateur du produit. La première architecture colle. Le premier jeu d'évaluations devient le tableau de bord. Les bizarreries du premier modèle deviennent le comportement du produit. Le premier workflow qui marche devient ce que les clients attendent.
Quand les achats ou la finance arrivent enfin, la partie "gratuite" est peut-être terminée.
Mais la dépendance est là.
Ce n'est pas un complot. C'est de la distribution.
Les clouds l'ont fait. Les SaaS l'ont fait. Les plateformes développeurs l'ont fait. Les labs IA le font avec une matière première plus coûteuse et un rôle plus intime dans le workflow.
La différence, c'est que l'IA ne se contente pas d'héberger le produit.
Elle peut le façonner.
Le compteur devient plus honnête
La page de Google sur les limites d'usage de Gemini est un petit signal utile, parce qu'elle rend l'abstraction visible.
Une requête n'est pas une requête.
Demander un résumé d'e-mail n'est pas le même objet économique que générer une vidéo, lancer une recherche approfondie, utiliser un modèle de raisonnement lourd ou laisser un agent enchaîner beaucoup d'étapes avec des outils.
C'est évident jusqu'au moment où une équipe essaie de le budgéter.
L'ancien modèle mental côté consommateur ressemblait à ceci :
Je paie mon abonnement IA, donc j'utilise l'IA.
Le nouveau modèle ressemble plutôt à ceci :
Je paie pour accéder à un panier mouvant de capacités, et chaque capacité consomme une quantité différente de calcul rare.
C'est une meilleure description de la réalité.
C'est aussi moins confortable.
Parce que cela veut dire que les prix de l'IA vont continuer à se rapprocher de compteurs, de quotas, de files prioritaires, de niveaux de modèles et de conditions d'usage raisonnable qui dépendent de ce que le modèle fait réellement.
Pour les particuliers, le produit paraît moins magique quand le compteur apparaît.
Pour les entreprises, cela veut dire que la finance et l'ingénierie doivent comprendre le même tableau de bord.
Bon courage à tout le monde.
La question des données n'est pas une seule question
Il y a une autre facture cachée derrière les crédits :
les conditions de données.
Les équipes posent souvent une question trop vague : "Est-ce qu'ils entraînent leurs modèles sur nos données ?"
Cette question est nécessaire.
Elle ne suffit pas.
OpenAI indique sur sa page de confidentialité entreprise ne pas entraîner ses modèles sur les données business par défaut. Anthropic indique dans son centre de confidentialité ne pas utiliser les entrées et sorties commerciales de Claude pour entraîner ses modèles par défaut, sauf opt-in du client ou feedback fourni dans un cadre couvert par sa politique.
Ces contrôles comptent.
Mais les acheteurs doivent poser des questions plus précises :
- Qu'est-ce qui compte comme contenu client ?
- Qu'est-ce qui compte comme métadonnée ?
- Qu'est-ce qui est conservé ?
- Peut-on désactiver ou raccourcir les logs ?
- Les prompts, sorties, fichiers, traces d'outils, évaluations ou retours utilisateurs sont-ils traités différemment ?
- L'entreprise peut-elle exporter son historique d'usage ?
- Peut-on prouver quel modèle a traité quelle requête ?
- Qu'est-ce qui change quand un produit passe d'un programme gratuit à un plan entreprise payant ?
La réponse peut être parfaitement raisonnable.
Mais "raisonnable" ne veut pas dire "compris."
La plupart des équipes ne se font pas piéger parce qu'un fournisseur fait quelque chose de caricaturalement malveillant en secret.
Elles se font piéger parce que personne n'a écrit les détails opérationnels ennuyeux avant que le workflow devienne important.
Le ROI arrive après le pilote
La vérité gênante, c'est que les crédits gratuits peuvent rendre l'IA meilleure qu'elle ne l'est.
Pas parce que le modèle est faux.
Parce que le pilote est faux.
Un pilote ignore souvent la moitié du coût :
- l'intégration
- la maintenance des prompts et des évaluations
- la revue sécurité
- les boucles d'approbation humaine
- les exécutions ratées
- la gestion du contexte
- les coûts de changement de fournisseur
- le support interne
- les mises à jour de modèles qui changent le comportement
- la gouvernance de qui peut utiliser quoi
C'est acceptable quand l'objectif est l'exploration.
C'est dangereux quand le pilote devient le business case.
L'IA agentique aggrave le sujet parce qu'un agent transforme une demande utilisateur en plusieurs appels modèle. Un workflow qui ressemble à une seule action peut inclure de la planification, de la recherche dans des fichiers, du web, des appels d'outils, des tentatives, de l'exécution de code, de la synthèse et de la relecture.
L'utilisateur voit un bouton.
La facture voit une petite expédition.
C'est pour cela que le cadrage d'OpenAI sur le pilotage des investissements est plus intéressant qu'un blog post de lancement classique. Le marché passe de "essayons l'IA" à "opérons l'IA." Les contrôles d'usage, refacturations internes, validations, évaluations, politiques de données et routage de modèles ne sont donc plus du théâtre d'entreprise.
Ils deviennent le produit.
La checklist acheteur
Si vous êtes une startup, les crédits gratuits sont très utiles.
Prenez-les.
Mais ne les laissez pas réfléchir à votre place.
Avant de construire un vrai workflow autour d'une IA subventionnée, une équipe devrait savoir :
- Que se passe-t-il quand les crédits expirent ?
- Quelles fonctions sont incluses dans l'offre gratuite ou startup ?
- Les protections de données sont-elles les mêmes entre les plans gratuit, startup, team et enterprise ?
- Le workflow peut-il tourner sur un autre modèle sans réécrire le produit ?
- Les prompts, évaluations, traces et logs d'usage sont-ils portables ?
- Quel est le coût par tâche réussie, pas par requête ?
- Quelles tâches nécessitent le modèle cher ?
- Quelles tâches peuvent utiliser un modèle moins cher ou un système local ?
- Qui peut approuver les exécutions plus coûteuses ?
- Que voit l'utilisateur quand le quota est atteint ?
Ce dernier point est sous-estimé.
Les utilisateurs se moquent du raffinement économique de votre modèle de quotas.
Ils savent seulement que la fonction marchait hier et ne marche plus aujourd'hui.
Gratuit est une phase, pas une stratégie
Le marché de l'IA est encore en mode conquête.
Les entreprises de modèles veulent de l'usage. Les clouds veulent des workloads. Les startups veulent de la runway. Les entreprises veulent de la productivité sans admettre qu'elles ne savent pas encore la mesurer.
Le marché va donc continuer à produire des remises, bundles, pilotes, crédits, offres gratuites et promotions étonnamment généreuses.
Utilisez-les.
Mais traitez-les comme un environnement de prix temporaire, pas comme une loi de la physique.
La vraie facture de l'IA n'est pas seulement la ligne de facturation.
C'est le compteur, la politique de données, la dépendance workflow, le coût de sortie, la charge d'évaluation, la revue humaine et le moment où une expérience subventionnée devient une infrastructure.
L'IA gratuite peut être une excellente affaire.
À condition de savoir ce que vous achetez avant que le prix apparaisse.