IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Les entreprises recherchent des solutions d'IA moins coûteuses alors que le « tokenmaxxing » perd de son attrait en tant que tendance éphémère,
L'IA est trop chère et n'est rentable pour personne

Le , par Patrick Ruiz

193PARTAGES

8  0 
Le tokenmaxxing a été institué dans le développement de logiciels comme mesure superficielle de la productivité et signal d'adoption de l'intelligence artificielle, encouragé par des classements internes et l'idée que plus de consommation d'IA équivaut à plus de performance. La tendance qui a pris son envol à l’entame de l’année 2026 n’est plus soutenable par les entreprises sur le long terme. En effet, les rapports se succèdent et font état de ce que « l’intelligence artificielle coûte trop cher et n’est rentable pour personne. »

Plusieurs grands groupes technologiques ont officialisé des restrictions budgétaires face à cette explosion des coûts

Uber Technologies a équipé 5 000 de ses ingénieurs d'assistants de codage dopés à l'IA, entraînant une surconsommation massive de jetons. L’entreprise a ensuite du faire face à une crise financière imprévue après avoir épuisé la totalité de son budget annuel alloué à l'IA en seulement quatre mois. Cela a poussé la direction à à qualifier les coûts de « difficiles à justifier » et à imposer un plafond strict de 1 500 $ par mois et par outil pour chaque employé.

En juin, un tableau de bord interne de Meta Platforms, baptisé « Claudeonomics », a révélé que 85 000 employés ont brûlé plus de 60 000 milliards de jetons en un mois, entraînant une intervention de la direction pour restreindre ces usages non régulés.

Au cours de ce mois qui tire à son terme, des responsables technologiques, à l'instar d'Amazon (via son CTO Werner Vogels), ont confirmé publiquement une transition accélérée des grandes organisations vers des modèles open source ou des alternatives locales moins onéreuses pour échapper à la facturation unitaire agressive des modèles propriétaires.

Gartner prévoit que les coûts liés au codage par IA dépasseront le salaire moyen d'un développeur d'ici 2028

L'intelligence artificielle (IA), longtemps présentée comme un outil censé améliorer la productivité tout en maîtrisant les coûts, devient un fardeau financier pour certaines organisations. Les dépenses des entreprises en matière d'IA montent en effet en flèche, certaines d'entre elles payant désormais davantage pour la puissance de calcul que pour la main-d'œuvre humaine. Alors que les coûts augmentent et que les retours sur investissement restent incertains, les dirigeants commencent à se demander si l'essor de l'IA est durable et si cette technologie est vraiment moins coûteuse que la main-d'œuvre humaine.

Récemment, Gartner, Inc., une société spécialisée dans les analyses commerciales et technologiques, a déclaraé que d’ici 2028, les coûts liés au codage IA dépasseront le salaire moyen d’un développeur en raison de l’augmentation de la consommation de jetons des grands modèles de langage (LLM) et du passage à des modèles de licence basés sur la consommation. Les jetons IA (tokens) sont les unités de données traitées par les modèles d’IA générative. La consommation de jetons a un impact direct sur le coût des outils de codage IA, en particulier dans le cadre de structures tarifaires basées sur la consommation.

« Les entreprises passent rapidement de la phase d’expérimentation au déploiement à grande échelle d’agents de codage IA, mais beaucoup sous-estiment l’impact financier de l’augmentation de la consommation de jetons », a déclaré Nitish Tyagi, analyste principal senior chez Gartner. « La maîtrise de la consommation de jetons ne résultera pas uniquement des choix des développeurs, car ceux-ci ont tendance à privilégier la rapidité et la commodité au détriment de la rentabilité. Sans un modèle opérationnel d’ingénierie bien encadré, les coûts peuvent grimper plus vite que les gains de productivité que ces outils sont censés apporter. »

En gros, l'IA coûte trop cher et n'est rentable pour personne

En mai 2026, l'analyste Edward Zitron étrille à nouveau le modèle économique de l'IA. Dans une analyse critique, il affirme que le secteur traverse actuellement une bulle financière insoutenable en raison de coûts d'infrastructure et d'exploitation démesurés. Les acteurs investissent des milliers de milliards de dollars sans générer de revenus réels capables de justifier de telles dépenses. Anthropic et OpenAI sont critiqués pour leurs pertes massives et l'absence de modèle économique rentable à long terme. L'éclatement de la bulle serait un carnage.

Edward Zitron soutient que « l'IA n'est actuellement viable sur le plan économique pour aucun acteur », à l'exception des constructeurs de centres de données et des fabricants de matériel comme Nvidia. Selon les rapports financiers, les startups du secteur perdent des sommes colossales chaque année, tandis que les géants de la technologie investissent des centaines de milliards de dollars sans aucune perspective de rentabilité à long terme. En fin de compte, des analyses suggèrent que Google pourrait être le seul gagnant, grâce à son importante réserve de liquidités.

C'est cette situation économique qui a conduit la fin de l'ère du forfait illimité. Derrière la guerre des modèles que se livrent les grands laboratoires d'IA se joue une bataille moins visible mais tout aussi décisive : celle de la monétisation. Le token, cette unité atomique de traitement du texte, est en train de redéfinir en profondeur les rapports entre fournisseurs, entreprises clientes et développeurs. Et les stratégies divergentes d'Anthropic et d'OpenAI révèlent deux visions radicalement différentes de ce que devrait être l'économie de l'intelligence artificielle.

Anthropic a choisi la rigueur comptable. La réponse d'Anthropic a été de s'éloigner de la tarification forfaitaire pour les entreprises et d'adopter la facturation à la consommation de tokens, de sorte que les revenus collectés reflètent l'usage réel. La société a également coupé l'accès à certains outils tiers qui étaient de gros consommateurs de tokens. OpenAI, de son côté, a longtemps privilégié la croissance de la consommation à tout prix. Pendant qu'Anthropic opérait ce virage, OpenAI rendait l'IA moins chère et plus facile à consommer à grande échelle. Cependant, même OpenAI a reconnu publiquement lors d'un podcast que « il est possible que dans l'ère actuelle, avoir un plan illimité revienne à avoir un plan d'électricité illimité. Ça n'a tout simplement pas de sens. »

La solution viendra-t-elle de la Chine qui met gratuitement à disposition ses meilleurs modèles d’IA ?

Les grands modèles de langage (LLM) développés par la Chine, comme Kimi K3 de Moonshot, GLM-5.2 de Z.ai ou encore les systèmes de DeepSeek, connaissent une adoption massive et rapide aux États-Unis. Ces technologies chinoises séduisent de plus en plus les développeurs américains et les organisations, qui y voient des solutions particulièrement abordables et efficaces face aux offres locales souvent beaucoup plus chères et moins flexibles.

La performance des modèles d'IA chinois égale désormais celle des systèmes développés par les géants de la Silicon Valley, mais pour une fraction du coût, ce qui a permis à Kimi K3 de générer plus de 930 000 téléchargements dans la semaine suivant son lancement. La demande pour le modèle a explosé peu après son annonce, poussant Moonshot AI à suspendre temporairement les nouveaux abonnements, car ses capacités étaient insuffisantes.

Raffi Krikorian, directeur technique de Mozilla, a d'ailleurs adopté Kimi K3 pour ses tâches quotidiennes. « Il semble tout simplement plus réactif », déclara-t-il en comparant Kimi K3 au modèle Claude Fable d'Anthropic. Cet attrait économique devient d'autant plus stratégique avec l'usage croissant des agents IA autonomes effectuant des tâches complexes en plusieurs étapes. Pour de nombreux développeurs, il s'agit d'une solution plus abordable.

Curt Meinhold, un cadre technologique américain, résume cet avantage compétitif comme suit : « si je peux payer quelques centimes pour un million de tokens de sortie au lieu de 30, 40 ou 50 dollars, alors c'est largement suffisant ». Les performances de Kimi K3 auraient à elles seules suffi à intensifier la rivalité entre les États-Unis et la Chine. À Washington, la montée en puissance chinoise dans l'IA suscite un malaise, ainsi que des inquiétudes.

Même si dans la pratique, il reste à voir si les modèles d'IA de pointe à poids ouverts sont réellement moins coûteux à exploiter, ils ont historiquement constitué une alternative moins onéreuse aux systèmes propriétaires d'OpenAI, de Google et d'Anthrpic. Ils offrent également davantage de liberté aux développeurs, à l’heure où les laboratoires américains restreignent l’accès à leurs derniers modèles d'IA et imposent des contraintes plus strictes.

Et vous ?

La facturation à l'usage est-elle intrinsèquement plus juste que l'abonnement illimité ou favorise-t-elle simplement les grandes entreprises disposant de budgets IT prévisibles au détriment des développeurs indépendants ?

La montée en puissance des modèles open source locaux (DeepSeek, Llama, Mistral) constitue-t-elle une alternative crédible à l'inférence cloud pour les workflows de développement quotidiens en 2026 ?

Cette tendance à la fin des subventions d'inférence marque-t-elle le début d'une consolidation du marché des assistants IA pour développeurs, avec un nombre réduit de gagnants capables de maintenir des prix compétitifs à long terme ?

Voir aussi :

L'âge d'or du forfait IA illimité tire à sa fin : pubs ciblées, limitations d'usage, fonctionnalités verrouillées, prix en hausse. L'IA agentique contraint les fournisseurs à changer leurs modèles économiques

Anthropic bloque l'utilisation par des clients tiers des abonnements à Claude Code : la fin de l'interopérabilité et de l'ouverture des outils de dev ou simple épisode dans la bataille des assistants IA ?

Après qu'Anthropic ait bloqué brutalement Openclaw techniquement et légalement, Sam Altman l'opportuniste en profite pour récupérer le bébé dans le giron d'OpenAI
Vous avez lu gratuitement 221 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Artaeus
Nouveau Candidat au Club https://www.developpez.com
Le 08/09/2026 à 9:25
De là à faire le lien avec les communications alarmistes de Anthropic et OpenAI sur les IAs dangereuses qu'il faut réguler tout de suite ...
Oups
3  1 
Avatar de Uther
Expert éminent sénior https://www.developpez.com
Le 08/09/2026 à 11:05
Citation Envoyé par Anselme45 Voir le message
2. Qui a été une cible privilégiée des "malheureuses" et involontaires cyberattaques des agents de OpenAI et Anthropic? (...silence... Méchante, méchante IA, devenue complètement incontrôlable (...silence...) A moins que ) Hugging Face!
La on vire dans le complotisme. Si le but était vraiment de nuire a Hugging Face, il s'y seraient pris autrement, de manière bien plus discrète et efficace.
Les dégâts de Open IA sur Hugging Face ont été minimes, rapidement identifiés et reconnus. Au final, ça leur a plus fait de la pub qu'autre chose.

Citation Envoyé par Anselme45 Voir le message
3. Qui vient de prendre le contrôle de Hugging Face en mettant 13 milliards de $ sur la table? (...silence...) Nvidia!
Nvidia, cela vous dit quelque chose? (...silence...) Vous savez la société qui fait sa fortune avec l'IA et qui est investisseur de OpenAI et Anthropic!!!!
Les IA open source utilisent elle aussi majoritairement les puces Nvidia. Nvidia n'a pas un besoin absolu de Open AI et d'Anthropic, tant qu'il y a de la demande au niveau des machines. Au contraire, ces gros acteurs essaient de développer en parallèle leur propre puces spécialisées dans l'IA qui leur permettraient d’échapper a son hégémonie. L'investissement de NVidia dans Hugging Face est justement pour garantir un accès libre à des modèle d'IA une plus grande diversité de client qui auront besoin de son matériel pour les faire fonctionner.

Citation Envoyé par Anselme45 Voir le message
Il n'est pas interdit de prendre connaissance des news et d'y voir un lien entre-elles...
Certes mais il faut y réfléchir sous tous les aspect pas uniquement tracer des ligne vers ce qu'on a envie de voir.
3  1 
Avatar de OrthodoxWindows
Membre expert https://www.developpez.com
Le 08/09/2026 à 11:19
Citation Envoyé par Artaeus Voir le message
De là à faire le lien avec les communications alarmistes de Anthropic et OpenAI sur les IAs dangereuses qu'il faut réguler tout de suite ...
Oups
Clairement. OpenAI et Anthropic soufflent depuis au moins deux ans le chaud et le froid, avec un en même temps que même Macron aurai du mal à égaler.
Parfois, ils se disent, (notamment OpenAI) presque accélérationiste, affirme qu'il faut foncer tête baissée vers une société qui sera utopique grâce à l'IA, que l'on s'approche (soit-disant) de l'AGI...
Et de l'autre, ils nous disent que l'IA est dangereuse, que ça serait irresponsable qu'il n'y ai pas de régulations gouvernementale, ce qui est en complète contradiction.

Il y a clairement, dans les deux cas, une volonté de berner de l'investisseur, par le sensationnalisme. Mais au delà, y voir un moyen que pourrait avoir ces entreprises pour faire accoucher une réglementation bloquant le marché de l'IA open-source, il n'y a qu'un pas que je suis de plus en plus près à franchir.
D'autant plus que la possibilité de pouvoir faire interdire de manière législative certains programmes open-source (en faisant interdire la diffusion du code source lui-même) est le rêve mouillée de beaucoup de big tech, ainsi que de certaines industrie du divertissement. Cela avait échoué avec le tentative d'interdire DeCSS (grâce à un grand mouvement de protestation) mais l'on voit bien que cette volonté revient, à la fois via les tentatives de lois sur les vérifications d'âge lors de l'installation de système d'exploitations (Brésil, Californie, Colorado...), mais aussi avec les LLM open-source (dernièrement, le consortium AI Forensics s'en est presque directement pris à HuggingFace, en pondant un avis qui ne peut que favoriser l'IA centralisée de source fermée).

Il ne faut pas non plus oublier que la majorité du marché des LLMs open-source est chinois, et s'inscrit donc dans le contexte de la guerre économique entre Chine et États-Unis. États-Unis qui, pour protéger leur marché, aurai de plus en plus intérêt à faire adopter un type de réglementation contraignant un développement plus ouvert des LLMs, surtout à l'heure où de nombreuses entreprises se rendent compte des avantages évident de choisir des LLM rendant moins dépendant à l'entreprise l'ayant fabriqué (ce qui est évoqué dans l'article)
2  0 
Avatar de Matthieu Vergne
Expert éminent https://www.developpez.com
Le 30/07/2026 à 21:02
J'utilise des modèles locaux. Je ne me pose pas de question de limites de tokens ni ne subit de biais psychologique à chercher à faire du tokenmaxxing vu que c'est strictement lié à mes besoins réels. Ce genre de problème disparaît totalement quand on passe aux modèles locaux. Et on n'a pas besoin d'un modèle de trilliards de paramètres pour faire du code efficacement.
1  0 
Avatar de Matthieu Vergne
Expert éminent https://www.developpez.com
Le 31/07/2026 à 20:41
Non pas testé. Là je met en place mon homelab depuis quelques mois et avec l'IA ça rend la chose bien plus accessible malgré mes exigences, du coup ça avance bien et j'ai donc d'autres priorités.

Ensuite tu peux le télécharger mais il est gros quand même. Du Qwen 3.6 à 35M de paramètres ça me suffit largement. Je ne suis pas dans la course à qui aura la plus grosse, je veux juste que ça réponde à mon besoin avec une taille raisonnable. Je peux faire tourner plus gros et je testerai sûrement ça un jour, mais genre pour challenger sérieusement quelque chose, comme Mythos utilisé pour analyser la sécu. Mais pas besoin de ça pour mon besoin quotidien donc sujet non prioritaire.
1  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 08/09/2026 à 10:12
Les entreprises se tournent vers l'IA open source pour gagner en flexibilité et réduire leurs coûts. Cette tendance menace la viabilité d'OpenAI et d'Anthropic
OpenAI, Anthropic et leurs petits copains ont déjà pris les mesures pour que les IA open source ne soient jamais des concurrents!!!

1. Jusqu'à ce jour, les IA open source ont utilisés quel moyen pour être distribués au plus grand nombre? (...silence...) Le site Hugging Face!

2. Qui a été une cible privilégiée des "malheureuses" et involontaires cyberattaques des agents de OpenAI et Anthropic? (...silence... Méchante, méchante IA, devenue complètement incontrôlable (...silence...) A moins que ) Hugging Face!

3. Qui vient de racheter Hugging Face en mettant 13 milliards de $ sur la table? (...silence...) Nvidia!

Nvidia, cela vous dit quelque chose? (...silence...) Vous savez la société qui fait sa fortune avec l'IA et qui est investisseur de OpenAI et Anthropic!!!!

(...un ange passe...)

Il n'est pas interdit de prendre connaissance des news et d'y voir un lien entre-elles...
2  1 
Avatar de Uther
Expert éminent sénior https://www.developpez.com
Le 08/09/2026 à 14:54
Citation Envoyé par Anselme45 Voir le message
Ce n'est pas OpenAI qui a rapidement identifié et reconnu l'attaque de Hugging Face, ce sont les collaborateurs de Hugging Face qui ont repéré l'attaque et qui ont pris les mesures pour l'arrêter!!!
Ça tombe bien, je n'ai absolument pas dit le contraire. Je n'avais pas pris la peine de détailler le rôle de Hugging Face et Open AI dans l'histoire car quoi qu'il en soit : cette attaque n'était pas un menace existentielle pour Hugging Face et elle n'était pas particulièrement discrète, ce qui a en effet poussé OpenAI à le reconnaitre. Si c'était un complot, il serait particulièrement nul.

Il n'y a pas de raison d'y voir autre chose que les autres cas d'IA qui sortent de leur environnement, que l'on a pu constater ces derniers temps, et qui n'ont pas particulièrement visé Hugging Face.

Citation Envoyé par Anselme45 Voir le message
Alors quand on crie au "complotisme" et que l'on veut jouer au "Zorro, défenseur de l'orphelin et l'OpenAI opprimé"... On se renseigne!!!
J'étais bien au courant de la situation, du moins autant que vous, il semble. Et non je ne tiens certainement pas a prendre la défense du pauvre Open AI. Il y a énormément de choses très factuelles à leur reprocher, pas besoin de tomber dans les spéculations hasardeuses.
1  0 
Avatar de Artemus24
Expert éminent sénior https://www.developpez.com
Le 31/07/2026 à 11:56
@Matthieu Vergne : utilises tu en local Deep Seek ? Je sais que l'on peut le télécharger. Qu'est-ce que tu en penses ?
0  0 
Avatar de Artemus24
Expert éminent sénior https://www.developpez.com
Le 01/08/2026 à 2:25
Quand j'aurai finalisé mon projet de réseau local domestique, je pense m'investir dans l'installation local d'une IA, pour mon usage personnel.
0  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 08/09/2026 à 11:31
Citation Envoyé par Uther Voir le message
Les dégâts de Open IA sur Hugging Face ont été minimes, rapidement identifiés et reconnus. Au final, ça leur a plus fait de la pub qu'autre chose
Faux!`

Ce n'est pas OpenAI qui a rapidement identifié et reconnu l'attaque de Hugging Face, ce sont les collaborateurs de Hugging Face qui ont repéré l'attaque et qui ont pris les mesures pour l'arrêter!!!

L'attaque a été détectée et dénoncée et ce n'est que par la suite que OpenAI a reconnu les faits... Ils n'avaient pas le choix: Quand tu retrouves juché sur une chaise en train de voler les pots de confiture de grand-mère, difficile de dire que tu y es pour rien

Alors quand on crie au "complotisme" et que l'on veut jouer au "Zorro, défenseur de l'orphelin et l'OpenAI opprimé"... On se renseigne!!!

Dont acte...
2  2