RnD Café #448 : 12 872 dollars : ce que coûte vraiment mon mois d’IA

10 octobre 2026

Au sommaire cette semaine

Lecture : 16 minutes, Expresso audio : 13 minutes

  • L’édito : ennemi des États-Unis, et 64 fois mon forfait
  • La token économie : piloter avant que les prix ne montent
  • Être choisi par l’agent
  • L’émotion n’était pas un refuge
  • Les brèves de la semaine

RnD Ristretto

La synthèse du numéro, produite à partir des 1125 sources de la semaine avec Gemini Notebook : à écouter en voiture, ou à parcourir en quelques slides.

La veille de la semaine en podcast 13′
Résumé vidéo
Les slides de la semaine

Le RnD Café n°448 en une infographie
Tout le numéro en une infographie

Ennemi des États-Unis, et 64 fois mon forfait

Par Alexis Rollin, RnD Intelligence Appliquée

Jeudi, j’ai appris que j’étais devenu un ennemi des États-Unis.

Le 29 septembre, un décret présidentiel a imposé aux administrations fédérales de dire « Super Intelligence » à la place d’« Artificial Intelligence ». Devant l’ONU, Trump avait expliqué que le mot « artificiel » donnait l’impression d’un faux, et que « SI » sonnait bien mieux. Jeudi 8 octobre, Donald Trump a précisé sa pensée sur Truth Social : la Maison-Blanche considère quiconque emploie encore « Artificial Intelligence » comme « THE ENEMY! ». Les majuscules sont de lui.

Le message de Donald Trump sur Truth Social, jeudi 8 octobre
Le message de Donald Trump sur Truth Social, jeudi 8 octobre

Je plaide coupable. J’écris « intelligence artificielle » tous les samedis, et je compte continuer.

Selon Axios, la Maison-Blanche elle-même dit encore « artificial intelligence » sur le site de son office scientifique. Et le site AI.gov affiche désormais « SI.gov » en très gros caractères, alors que l’adresse SI.gov mène à une page d’erreur. Effet de bord savoureux : les noms de domaine en .si, l’extension de la Slovénie, s’arrachent. Plus de 46 000 enregistrés en septembre, contre environ 3 500 en août, relève Bertrand Leblanc-Barbedienne.

Voilà voilà…

Mais changer le nom change-t-il la facture ? Non. Et justement, la facture, je l’ai (re)calculée cette semaine.

Je le répète beaucoup en ce moment : nous ne sommes pas prêts à la hausse des prix de l’IA qui nous attend, sans doute d’ici peu.

Pour faire court : la bulle de l’IA continue d’enfler. Plusieurs indicateurs dépassent déjà ceux de la bulle internet de 1999 : le secteur technologique pèse près de 40 % de la Bourse américaine, plus qu’au sommet de l’époque. Mieux : selon le Wall Street Journal, relayé par Brian Solis, les États-Unis investiraient 10 300 milliards de dollars dans leurs centres de données de 2025 à 2032, 3,6 % de leur PIB chaque année. C’est plus que les chemins de fer, les autoroutes ou l’électrification en leur temps.

Dépense annuelle d'infrastructure en part du PIB américain : 3,63 % pour l'IA de 2025 à 2032, contre 2,24 % pour les chemins de fer (Wall Street Journal, d'après Stijn Van Nieuwerburgh)
Dépense annuelle d’infrastructure en part du PIB américain : 3,63 % pour l’IA de 2025 à 2032, contre 2,24 % pour les chemins de fer (Wall Street Journal, d’après Stijn Van Nieuwerburgh)

Autre exemple cette semaine. SpaceX veut emprunter 40 milliards de dollars pour acheter des puces Nvidia, quatre mois après avoir levé plus de 85 milliards en Bourse, selon Axios. Emprunter pour investir n’a rien d’anormal. Le pari, lui, est plus risqué. On s’endette aujourd’hui pour des centres de calcul dont les revenus restent à venir, et l’argent finit chez Nvidia, dont la valeur dépend justement de ces achats. Les marchés commencent d’ailleurs à douter : le 7 octobre, le coût de l’assurance contre un défaut de SpaceX a atteint un record, relève le Financial Times. Ce n’est pas une preuve mais le genre de signal qu’on relit après coup.

Une conséquence probable : les labos d’IA devront renflouer leurs caisses, et les modèles que nous utilisons coûteront plus cher.

Je m’explique.

La plupart d’entre nous payons l’IA au forfait, soit un abonnement mensuel, quelle que soit la consommation. Mais plus nous passerons aux agents, plus nous paierons à l’usage, au jeton (le fameux token, ce morceau de mot que les modèles comptent et facturent).

Et on paie deux choses. Les jetons d’entrée (token in), c’est ce que le modèle lit : votre question, toute la conversation qui précède, les documents joints. Les jetons de sortie (token out), c’est ce qu’il écrit, et ils coûtent cinq fois plus cher chez Anthropic. Or un agent lit énormément pour écrire peu.

Hier, j’ai demandé à Claude de reprendre ma consommation d’août et de septembre, et de calculer ce qu’elle m’aurait coûté au prix public. Ce prix, c’est celui que paient les développeurs qui passent par l’API (l’accès direct aux modèles, facturé à la consommation). Moi, je paie donc un forfait.

Résultat pour septembre : 12 872 dollars. Pour un abonnement Max que j’ai payé 200 dollars par mois. Soixante-quatre fois le forfait. En août, c’était 9 550 dollars, quarante-huit fois.

Pour se représenter les volumes : en septembre, nos agents ont lu environ 15,8 milliards de jetons, l’équivalent d’environ 51 000 livres de 600 pages. Ils en ont écrit 46 millions, environ 150 livres. La raison, chez RnD : nous sommes en train de refaire une bonne partie de nos outils et de nos méthodes.

Il y a évidemment une marge dans le prix public : mes 12 872 dollars ne sont pas ce que je coûte réellement à Anthropic. Mais combien de temps vont-ils continuer à me/nous sponsoriser ? Le coût d’acquisition client est un peu cher, non ?

Mes sessions Claude Code valorisées au tarif public de l'API : 48 fois le forfait en août, 64 fois en septembre (cliquez pour voir la vidéo)
Mes sessions Claude Code valorisées au tarif public de l’API : 48 fois le forfait en août, 64 fois en septembre (cliquez pour voir la vidéo)

Cette vidéo, au passage, c’est Claude qui l’a fabriquée, en quelques minutes.

Et ce n’est qu’un début. Cette semaine, Anthropic a lancé Claude Dashboards et Claude Motion : Claude fabrique désormais des tableaux de bord qui se mettent à jour tout seuls, et des vidéos animées. Frédéric Cavazza y voit la prochaine étape : après le chatbot qui répond et l’agent qui exécute, viennent des « collaborateurs synthétiques », avec leur propre adresse mail et leur propre agenda, à qui plusieurs personnes confient des missions. Par exemple, fabriquer une vidéo comme celle de plus haut.

Ma conclusion : la token économie sera le sujet du premier trimestre. Quand on a un marteau, on a l’impression que tout est un clou. Utiliser le modèle le plus puissant pour résumer un mail, c’est confortable mais ce n’est pas responsable. Que ferez-vous si le prix de Claude, ou d’un autre, est multiplié par trois ou quatre au premier trimestre ? La réponse se prépare maintenant : surveiller ce que consomment vos agents, et choisir le bon modèle pour chaque tâche.
Sinon, je crains que le réveil ne soit un peu dur.


La token économie : piloter avant que les prix ne montent

Ce qu’il faut retenir de cet article
Même Microsoft rationne déjà ses équipes : plus d’un tiers de dépense en moins sur les outils d’Anthropic. Mettez dès maintenant un compteur dans vos agents, et raisonnez en coût par tâche plutôt qu’en prix du token.

Même les géants rationnent. Selon The Information, Microsoft a réduit de plus d’un tiers sa dépense interne en outils d’Anthropic, prévue à au moins un milliard de dollars cette année. Meta ramène ses licences Claude Code d’environ 60 000 à 30 000. Ce sont évidemment aussi des concurrents d’Anthropic, soit. Mais quand les plus riches comptent, c’est qu’il y a quand même un sujet.

De leur côté, OpenAI et Anthropic vendent leurs forfaits à un prix qui ne couvre pas ce qu’ils consomment. Selon SemiAnalysis, les abonnements ne font que 10 % des revenus d’Anthropic, mais mobilisent plus de 40 % de sa puissance de calcul. OpenAI divise par deux la valeur de son forfait à 200 dollars et crée une offre à 500. Anthropic ajoute des crédits d’API à ses offres Max et Team : 100 ou 200 dollars par mois sur les offres Max, jusqu’à 500 dollars mutualisés pour une équipe, utilisables sur l’API. Habile : l’abonné apprend à consommer à l’unité.

Chez Anthropic, les abonnements pèsent 41,7 % du calcul pour 10 % des revenus (SemiAnalysis)
Chez Anthropic, les abonnements pèsent 41,7 % du calcul pour 10 % des revenus (SemiAnalysis)

Le prix au jeton ne dit pas la facture.

Attention au piège du prix affiché. Un modèle se facture au token, mais une même tâche peut en consommer peu ou beaucoup, selon que le modèle « réfléchit » longuement ou va droit au but. Selon Artificial Analysis, Sonnet 5.5, réglé au maximum, écrit environ 193 000 jetons pour accomplir une tâche de son banc d’essai, sept fois plus que GPT-6 Astra. Résultat : environ 7,60 dollars la tâche.

Il va falloir s’habituer à chiffrer chaque tâche que fait votre agent, comme on chiffre l’heure de votre prestataire adoré.

Intelligence des modèles et coût par tâche : les deux ne vont pas ensemble (Artificial Analysis)
Intelligence des modèles et coût par tâche : les deux ne vont pas ensemble (Artificial Analysis)

Pire : économiser peut coûter plus cher. GitHub a raccourci ce que lit son agent de code, et chaque tâche a coûté davantage. Chaque information manquante déclenchait un tour de plus. Dit autrement : un agent mal nourri repasse au guichet.

Qui paie, au fond ? Le classement d’a16z sur l’IA grand public répond : 1 % des payeurs fait 19,5 % de la dépense, plus que la moitié inférieure réunie. 84 % des applications d’IA vivent de l’abonnement, 14 % seulement de la publicité. Emmanuel Vivier résume : « Pendant 20 ans, l’internet grand public nous a fait payer avec notre attention. L’IA grand public, elle, nous envoie la facture. »

Les cinquante applications d'IA grand public qui encaissent le plus (a16z)
Les cinquante applications d’IA grand public qui encaissent le plus (a16z)

Des vendeurs fragiles. Le Financial Times ramène les revenus annualisés d’OpenAI à environ 50 milliards de dollars, contre 70 annoncés, selon Le Monde. Anthropic porte environ 518 milliards de dollars d’engagements de calcul, pour un peu plus de 20 milliards en caisse fin 2025, calcule Silicon Carne. La directrice du FMI range l’ampleur des investissements dans l’IA parmi trois risques pour la croissance mondiale, et la Banque d’Angleterre relève environ 450 milliards de dollars de dette liée à l’IA émis dans le monde début septembre, selon Morgan Stanley. Le jour où ces vendeurs devront équilibrer leurs comptes, qui paiera ? À mon avis, nous.

Et donc ?

  • Installez dès maintenant une surveillance des tokens dans vos agents : qui consomme, combien, pour quelle tâche.
  • Calculez le coût par tâche, pas le prix au token. Demandez-le à vos fournisseurs, et mesurez-le sur vos propres usages.
  • Choisissez le bon modèle pour chaque tâche. Un petit modèle suffit pour résumer un mail ; gardez le plus puissant pour ce qui le justifie.
  • Ne bâtissez pas un processus critique sur un tarif subventionné, et gardez un second fournisseur testé, pour ne pas dépendre d’un changement de grille. Optez pour l’open source.
  • Pilotez l’IA comme une dépense d’énergie, conseille Brian Solis : consommation, taux d’utilisation, coût par résultat.

Être choisi par l’agent

Ce qu’il faut retenir de cet article
En France, une recherche Google sur deux affiche déjà une réponse rédigée par l’IA, et la presse est la première à en payer le prix. L’étape d’après est là : l’agent compare, achète, et pourrait bientôt résilier à la place de votre client. Demandez aux IA ce qu’elles disent de votre marque, puis rendez vos prix, vos stocks et vos fiches produits lisibles par une machine : c’est ce que l’agent lira avant de choisir, mais pas que…

Tapez le nom d’une grande marque dans Google aux États-Unis. Plus de huit fois sur dix, une réponse rédigée par l’IA s’affiche avant les liens : 82,91 % des recherches de marque fin septembre, selon Ahrefs. Wikipédia porte près de 72 % des citations de ces réponses.

Aperçus IA de Google sur les recherches de marque aux États-Unis : 73,3 % en moyenne en septembre (Ahrefs)
Aperçus IA de Google sur les recherches de marque aux États-Unis : 73,3 % en moyenne en septembre (Ahrefs)

Votre site est loin derrière. Avez-vous déjà demandé à ChatGPT ce qu’il dit de votre marque ?

Ahrefs vend l’outil qui mesure ce phénomène, je le précise. Mais la France suit. Sur deux millions de pages de résultats relevées en septembre, 50,8 % affichent un aperçu IA, selon Abondance. Et 48,6 % de ces aperçus se chargent après la page, donc échappent aux outils de suivi classiques. Difficile de piloter ce qu’on ne voit pas.

Bonne nouvelle quand même : Google commence à baliser les liens de Gemini pour qu’on reconnaisse ce trafic dans ses statistiques. Jusqu’ici, il se perdait dans le canal « direct ».

Les médias, premières victimes.

Aux Assises nationales de l’IA à Caen, Arnaud Wajdzik a posé les chiffres sur la table : Midi Libre à -35 %, Le Parisien à -43 %, ICI à -55 %. 33 marques d’information sur 40 reculent sur un an. Ouest-France a saisi l’Autorité de la concurrence. Son président parle du « casse du siècle ».

Le classement des marques d'information en septembre 2026 : Le Parisien à -43,5 % sur ses sites, Ouest-France à -9,1 % (ACPM, via Arnaud Wajdzik)
Le classement des marques d’information en septembre 2026 : Le Parisien à -43,5 % sur ses sites, Ouest-France à -9,1 % (ACPM, via Arnaud Wajdzik)

Dans le même temps, Ouest-France signe avec Microsoft une licence de droits voisins (la rémunération due aux éditeurs quand leurs contenus sont repris) : quatre ans, avec effet rétroactif, pour un montant non communiqué. Attaquer Google d’un côté, négocier avec Microsoft de l’autre : la presse teste les deux voies à la fois. Radio France rejoint de son côté la coalition SPUR, qui réclame la rémunération des contenus utilisés par l’IA.

Et pourtant, Ouest-France résiste mieux que les autres, à -9,6 %. Arnaud Wajdzik y voit une raison : l’information de proximité « se résume mal en trois lignes ». C’est une leçon pour toutes les marques. Ce qui est singulier, local, vécu, survit mieux au résumé.

Puis l’agent achète.

L’étape d’après est déjà là. Emmanuel Vivier le résume ainsi : « Le web vous a fait payer pour être trouvé. Les agents vous feront payer pour être choisi. » L’agent ne regarde pas votre campagne mais lit vos fiches produits, vos prix, vos stocks, vos conditions de retour.

Et les plateformes raccourcissent toujours plus le chemin jusqu’à l’achat. TikTok lance un assistant d’achat qui retient vos préférences, et le paiement en un clic depuis son fil « Pour toi », construit avec Shopify, Salesforce et Stripe. La découverte, le conseil et l’achat se jouent au même endroit, sans passer par votre site.

L'assistant d'achat de TikTok répond à une question, puis propose les produits à acheter (TechCrunch)
L’assistant d’achat de TikTok répond à une question, puis propose les produits à acheter (TechCrunch)

Les logiciels suivent le même chemin. Magma l’écrit sans détour : avec le MCP (le protocole qui permet à une IA d’agir dans un logiciel), « leurs clients pourraient bientôt piloter leurs outils sans jamais ouvrir leur interface ». Qonto en a ouvert un sur toutes ses formules. Un éditeur sans MCP verra son interface s’ouvrir de moins en moins souvent.

Et il y a l’agent qui ne lâche jamais. Marie Dollé montre qu’une partie de l’économie vit de nos renoncements : l’abonnement qu’on ne résilie pas, l’assurance jamais renégociée, la carte cadeau jamais utilisée. Un agent, lui, insiste. Pour une marque, être choisie par l’agent, c’est aussi ne pas être résiliée par lui.

Pendant ce temps, ChatGPT monétise. Sa publicité atteint un milliard de dollars annualisé selon OpenAI, cité par a16z, et la mémoire de ChatGPT sert au ciblage, relève Jérémy Lacoste. Souvenez-vous : nous en parlions dans la 447.

Et donc ?

  • Mesurez votre présence dans les réponses des IA, en répétant les questions : une seule mesure ne dit rien, les réponses changent d’un essai à l’autre.
  • Rendez vos données lisibles par une machine : fiches produits, prix, stocks, conditions. C’est ce que l’agent lit en premier.
  • Publiez de la matière originale : chiffres propres, retours de terrain, information de proximité. C’est ce qui survit au résumé. Mon camarade Romain Achard (The Ramp) vient de le faire pour Opel avec Le Vendeur Automobiles : une opération de géolocalisation racontée en vidéo, réalisée avec Opus 5.5.
  • Si vous éditez un logiciel ou un service, ouvrez un MCP officiel. Sinon, quelqu’un d’autre le fera à votre place en moins bien.

L’émotion n’était pas un refuge

Ce qu’il faut retenir de cet article
On pensait que l’humain garderait l’émotion, l’empathie et la présence. Cette semaine, un avatar vidéo a fait croire à près d’une personne sur deux qu’elle parlait à un humain.

On se rassurait comme on pouvait. L’IA saurait écrire, calculer, coder. Mais l’émotion, l’empathie, la présence resteraient à nous. Cette semaine, j’ai comme un doute.

La présence. En 1950, Alan Turing proposait un test simple : une machine est intelligente si, dans une conversation, on ne sait plus la distinguer d’un humain. La start-up Tavus affirme que son nouvel avatar, Griffin, vient de le réussir en vidéo. Elle a mis 54 personnes en visio d’une minute avec lui, sans les prévenir. 26 ont cru parler à un humain, rapporte Decrypt. La version précédente n’en avait trompé qu’une sur 41.

Une minute, c’est court, et l’étude vient de l’entreprise, sans vérification indépendante. Benoît Raphaël le dit lui-même : « Il y a bien sûr beaucoup de marketing dans cette histoire. » Mais la pente est là. L’avatar réagit à ce que vous dites, hoche la tête, semble vous regarder dans les yeux.

La démonstration de Griffin, l'avatar vidéo de Tavus (cliquez pour voir la vidéo)
La démonstration de Griffin, l’avatar vidéo de Tavus (cliquez pour voir la vidéo)

Jérémy Lacoste en tire la conséquence la moins agréable : le faux conseiller bancaire avait déjà une voix, il aura bientôt un visage.

L’émotion. Thierry Taboy croyait, comme beaucoup de musiciens, à une dernière ligne de défense : l’histoire, les fans, la scène. « Elle vient de tomber », écrit-il. Des artistes générés ont désormais des identités, des récits, des communautés de centaines de milliers d’abonnés, et même des retransmissions de « concerts ». Sa leçon : ce qui protégeait les musiciens, c’était moins la qualité de leur musique que l’attachement du public. Or le public s’attache aussi à des artistes qui n’existent pas.

Extrait d'une vidéo générée avec Kling, relayée par Thierry Taboy
Extrait d’une vidéo générée avec Kling, relayée par Thierry Taboy

L’envers du décor existe aussi. Un Américain vient d’être condamné à dix-huit mois de prison : il avait mis en ligne des milliers de morceaux générés, écoutés en boucle par de faux comptes. Son gain : plus de 8 millions de dollars de droits.

Le grand écran. « INCUBUS », premier film de Julien Prevost, un Français formé à l’école de Luc Besson, entièrement généré, a été récompensé au festival SHAIKE, selon The AI LIVE Show.

« INCUBUS », de Julien Prevost, film entièrement généré (The AI LIVE Show)
« INCUBUS », de Julien Prevost, film entièrement généré (The AI LIVE Show)

Et donc ?

Si une machine peut émouvoir, la question pour une marque change. Je crois que la technique ne fera bientôt plus la différence : tout le monde aura la même. Ce qui comptera, c’est la vérité de ce qu’on raconte, et la confiance qu’on vous accorde.


Les brèves

Les modèles

Mistral Large 4, « Le Chonk ». Mille milliards de paramètres, entraîné sur 4 000 puces Nvidia, poids ouverts annoncés pour le 27 octobre, selon Le Grand Continent. Mistral se dit au niveau des meilleurs modèles chinois d’il y a un mois ou deux. Jérôme Marin juge l’affirmation « en partie trompeuse ». Le test du Journal du Net le trouve brillant en français et en cybersécurité, en retrait sur le code. C’est un modèle ouvert et européen. Pour beaucoup d’entreprises, c’est déjà un sacré argument.

OpenAI publie 722 manuscrits de mathématiques. Ils ont été produits par un modèle interne, sur environ 4 000 problèmes ouverts, et seuls 162 ont leur résultat principal vérifié par un logiciel de preuve, selon OpenAI. Des mathématiciens protestent. Pour l’Association for Human Mathematics, personne n’a demandé ce travail, et publier 700 fichiers d’un coup n’est « pas une démonstration d’érudition, mais une démonstration de pouvoir ». Terence Tao, médaille Fields 2006, a publié la déclaration sur son blog, sans la signer. L’objection de fond : en mathématiques, une preuve vaut par ce qu’elle fait comprendre. Sept cents résultats que personne n’a cherchés ni compris, c’est du travail de vérification en plus, et pas une idée de plus.

La règle

« Le jour d’après ». Selon Axios, les dirigeants d’Anthropic, d’OpenAI et d’autres laboratoires se préparent en privé à un scénario précis : une catastrophe causée par l’IA, le plus probablement une cyberattaque qui couperait les banques, internet ou l’électricité, suivie d’une révolte de l’opinion et des élus contre eux. Beaucoup de gens du secteur ont confié à Axios qu’ils s’attendent à un tel accident dans les six à douze mois. OpenAI confirme mener des exercices de crise, tout en précisant que ces scénarios ne sont « pas tenus pour inévitables ».

ChatGPT marquera ses textes. Pour se conformer à l’AI Act, OpenAI va glisser un filigrane invisible dans le choix des mots des textes produits en Europe. Remplacez un quart des mots par des synonymes, et la détection tombe à 17 %. Google ouvre de son côté SynthID Detector à tous, pour images, vidéos et sons.

SynthID Detector, l'outil de Google pour reconnaître un contenu généré par IA
SynthID Detector, l’outil de Google pour reconnaître un contenu généré par IA

Siri, privé d’Europe. Apple ne déploie pas Siri AI en Europe et invoque des risques de sécurité liés au DMA (le règlement européen sur les marchés numériques). Bruxelles conteste, explique Cafétech. Souvenez-vous : dans la 447, les dots d’OpenAI n’arrivaient en France que par l’offre Business Premium.

L’argent

Assurer l’IA. Plus de 90 % des risques liés à l’IA relèvent de « l’IA silencieuse » : les contrats classiques ne les couvrent ni ne les excluent explicitement, selon le courtier Aon, qui s’appuie sur environ 300 procès liés à l’IA recensés depuis 2010. Votre police couvre-t-elle l’erreur d’un agent ? Posez la question à votre courtier avant d’en avoir besoin.

L’emploi

HSBC taille dans la gestion de patrimoine. Selon le Financial Times, repris par Reuters, jusqu’à 70 % des conseillers financiers de la gestion de patrimoine britannique de HSBC pourraient disparaître, dans une restructuration fondée sur l’IA. HSBC ne commente pas les chiffres. En regard, Gilles Babinet rappelle une analyse de la LSE sur 74 études : des effets sur l’emploi de -20 % à +40 %. Pour lui, la vraie question reste le partage de la valeur.


En ce moment chez RnD

Passez vos équipes à l’IA appliquée

Une journée de formation pour transformer la curiosité en réflexes de travail : cas d’usage par métier, ateliers pratiques, garde-fous. Du COMEX à l’opérationnel.


RnD Café : comment ça marche ?

Fonctionnement du RnD Café : veille, sélection, premiers jets, supervision

1125 sources lues cette semaine.
Ce dispositif agentique est conçu et piloté par RnD : le même savoir-faire que nous déployons chez nos clients.


Besoin d’un agent de veille ?

Newsletter

Chaque samedi matin retrouvez une synthèse des informations du marketing digital à replacer lors de votre prochaine réunion.