Microsoft limite l'usage de l'IA dans ses propres équipes
Depuis juillet, chaque division de Microsoft a un plafond de dépense IA. Celui qui possède les data centers trouve la facture assez lourde pour la compter.

Vingt-huit centimes de dollar d'un côté, 89,32 dollars de l'autre. C'est ce que coûte en tokens la même unité de travail livrée par un développeur, selon qu'il consomme peu ou beaucoup. Un rapport de 1 à 319, pour deux fois plus de travail effectivement livré.
Un écart pareil finit toujours par produire un budget. Chez Microsoft, c'est fait : depuis juillet, chaque division dispose d'un plafond de dépense IA.
Ce que dit la note interne
L'information vient de 404 Media, qui a obtenu le 4 août un email de Jay Parikh, executive vice president chez Microsoft, ainsi que la mise à jour des règles internes d'usage de Copilot. Le message tient en une phrase : « Tokenmaxxing is not what we are optimizing for. » Empiler les tokens n'est pas l'objectif. Le mot n'est pas une invention maison : il circule depuis des mois dans le milieu, et Parikh le reprend pour le désavouer.
Trois choses changent concrètement. Chaque division dispose depuis juillet 2026 d'un « AI token budget target ». Chaque salarié suit sa consommation individuelle sur un tableau de bord interne. Et le modèle par défaut en interne devient GPT-5.6, moins cher que ses alternatives, pour « get greater value from our token investment ».
Le tableau de bord individuel est le détail le plus parlant. C'est le compteur qu'on installe le jour où le forfait illimité devient une ligne de dépense.
Une réserve, et elle compte : Microsoft n'a pas répondu à la demande de commentaire de 404 Media. On parle donc d'un document interne rapporté par un tiers, et non d'une politique annoncée publiquement. Le socle reste solide : un email nominatif signé d'un dirigeant identifié, un référentiel interne daté, une reprise par Techmeme, Slashdot et The Next Web sans démenti à ce jour.
Le signal était déjà passé en mai
Microsoft avait retiré au printemps la plupart des licences Claude Code de son groupe Experiences and Devices, celui qui fabrique Windows, Microsoft 365, Outlook, Teams et Surface. Le mémo interne, révélé par The Verge le 15 mai, portait la signature de Rajesh Jha, l'EVP du groupe, et renvoyait des milliers de développeurs vers GitHub Copilot CLI avant la clôture de l'exercice, fin juin.
Les règles de juillet donnent l'ordre de grandeur qui manquait alors. Beaucoup d'ingénieurs de la maison dépensent en tokens, selon le document, de quelques centaines à quelques milliers de dollars par mois. Par personne.
Le prix baisse, la facture monte
Le prix unitaire du token diminue depuis deux ans, tous les fournisseurs le répètent, et c'est exact. Ce qui a changé, c'est le volume. Selon Nicholas Arcolano, head of research chez Jellyfish, la consommation par développeur a été multipliée par 18,6 en neuf mois.
La cause tient aux agents. Un développeur qui écrit ses prompts à la main a une limite physique : sa journée de travail. Un agent lancé le matin et qui tourne seul jusqu'au soir n'en a aucune. Personne ne regarde le compteur pendant qu'il tourne, et c'est précisément ce qu'on lui demande.
Ce que coûte vraiment un usage intensif
Jellyfish, qui mesure l'activité des équipes d'ingénierie, a publié les chiffres les plus précis du dossier : 12 000 développeurs, 200 entreprises, sur le premier trimestre 2026.
Le développeur médian coûte 52,38 dollars de tokens par mois. Au 75e centile, on passe à 226,58 dollars. Au 90e, à 691,14 dollars. Voilà le repère qui manque à la plupart des dirigeants qui regardent leur facture sans savoir si elle est normale.
Le rendement est la vraie information. Les 20 % de développeurs les plus sobres ont livré 11 pull requests fusionnées sur le trimestre, pour environ 3 dollars de tokens. Les 20 % les plus dépensiers en ont livré 23, pour environ 1 822 dollars. Soit 0,28 dollar contre 89,32 dollars par unité livrée. Jellyfish résume : dix fois plus de tokens pour environ deux fois plus de débit.
Doubler la mise pour doubler le résultat serait une bonne affaire. Multiplier la note par plus de trois cents pour doubler le résultat en est une autre.
Uber, Accenture, Amazon
Microsoft n'est pas seul, et n'a même pas été le premier. Uber a brûlé la totalité de son budget IA 2026 dès le mois d'avril, en quatre mois, avant de plafonner l'accès à Claude Code et Cursor le 2 juin. Amazon a supprimé un classement interne qui affichait ses plus gros consommateurs de tokens. Chez Priceline, un renouvellement de contrat Cursor est revenu quatre à cinq fois plus cher, raconte Chris Reed, directeur du contrôle de gestion informatique.
Le détail le plus contre-intuitif vient d'Accenture. Justice Kwak, qui y pilote la stratégie sur les agents, l'a dit lors d'une réunion interne dont l'audio a fuité : les données internes montrent que ce ne sont pas les ingénieurs qui tirent la consommation de tokens. Ce sont les autres, sur des tâches de routine comme transformer un PDF en présentation. Le même cabinet avait prévenu ses équipes en février que ne pas utiliser l'IA pouvait leur coûter une promotion.
La Linux Foundation a lancé en juillet une « Tokenomics Foundation » pour poser des standards de mesure et de facturation. Quand une industrie crée un organisme pour expliquer ses propres factures, c'est que le sujet a dépassé le stade de l'anecdote.
Pourquoi ça ne parle pas que de Microsoft
On a regardé il y a une semaine ce que l'IA coûte à Microsoft du côté des investissements : 35,8 milliards de dollars d'immobilisations sur le seul trimestre clos fin juin, et un carnet de commandes engagé de 678 milliards, en hausse de 84 %. C'était l'histoire d'une entreprise qui dépense énormément parce qu'elle a des clients au bout de la capacité construite.
Six jours plus tard, on apprend que la même entreprise compte les tokens de ses propres salariés. Les deux faits racontent la même histoire par ses deux bouts. Microsoft possède les data centers, revend le service, et paie donc l'IA au meilleur prix de revient possible sur le marché. Si le mieux placé du monde juge nécessaire de plafonner, personne n'a de raison de traiter ce coût comme du bruit de fond.
Un producteur d'électricité qui installe des minuteries dans ses propres bureaux connaît simplement le prix du kilowatt mieux que ses clients.
Ce qu'on ne sait pas
Aucun montant de plafond n'est public, ni le nombre de divisions concernées. On sait que les budgets existent, pas où ils sont posés.
Les chiffres de marché les plus repris ces dernières semaines, du type « les factures IA en entreprise ont triplé » ou « le budget IA moyen est passé de 1,2 à 7 millions de dollars », circulent sans source nommée. Les seuls chiffres solides du dossier viennent d'un éditeur d'outillage qui mesure ses propres clients. C'est une information en soi sur la maturité du sujet.
Enfin, la pull request fusionnée mesure du débit, pas de la valeur. Arcolano le reconnaît lui-même : savoir si la dépense extrême est rentable dépend de la valeur métier du code livré, que la plupart des entreprises ne savent toujours pas mesurer.
C'est exactement ce que Parikh demande à ses équipes dans son email : « We are not optimizing for fewer tokens. We are optimizing for more impact per token. » La formule est juste. Il se trouve que l'impact est la seule des deux grandeurs que personne ne sait encore compter.
Sujets abordés :
Questions fréquentes
Que dit exactement la note interne de Microsoft ?
Combien coûte un développeur en tokens chaque mois ?
Dépenser plus en tokens fait-il livrer plus de code ?
Pourquoi la facture monte-t-elle alors que le prix du token baisse ?
Qu'est-ce que le tokenmaxxing ?
Microsoft est-il le seul à plafonner la dépense IA de ses équipes ?

Alexandre Noto
Co-fondateur & Expert Tech
Alexandre est dans la tech depuis plus de 20 ans. Entrepreneur, architecte logiciel et passionné d'intelligence artificielle, il traduit les concepts complexes en explications accessibles. Chez Declic Media, il est la voix technique qui rend l'IA compréhensible pour tous.
Tous les articles de Alexandre →