IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Le PDG d'Anthropic estime que le coût de la formation d'un modèle d'IA atteindra bientôt 100 milliards de dollars,
Ce qui suggère que les entreprises échouent à réduire les coûts liés au développement de l'IA

Le , par Mathis Lucas

1.3KPARTAGES

5  0 
Dario Amodei, PDG d'Anthropic, a déclaré que le coût de développement d'un grand modèle de langage (LLM) est actuellement estimé à 100 millions de dollars. Mais ce coût augmente de façon exponentielle et pourrait franchir la barre des 100 milliards de dollars dans les années à venir. Il affirme que ce coût faramineux pourrait s'expliquer par la recherche d'algorithmes d'IA de plus en plus efficaces et d'éventuelles difficultés en matière de puissance de calcul et d'approvisionnement en puces d'IA. Ses déclarations donnent une idée des investissements colossaux qu'exige le développement de l'IA et des difficultés des entreprises à réduire ces coûts au fil des ans.

Les coûts liés à la formation des modèles d'IA augmentent de façon exponentielle

Un modèle d'IA est un programme qui analyse des ensembles de données pour trouver des modèles spécifiques et faire des prédictions. Il s'agit d'une illustration d'un système qui peut recevoir des données et tirer des conclusions ou mener des actions en fonction de ces conclusions. Les modèles d'IA peuvent être utilisés pour toute une série d'activités, de la reconnaissance d'images et de vidéos au traitement du langage naturel (NLP), en passant par les systèmes de recommandation et la modélisation prédictive, ainsi que la robotique et les systèmes de contrôle. Toutefois, leur formation a un coût excessif pour les entreprises.

Selon les experts, le coût de la formation d'un modèle n'a cessé d'augmenter depuis plusieurs années. Bien que des entreprises comme OpenAI et Google ne divulguent pas les coûts précis de la formation de modèles d'IA comme GPT-4 et Gemini, il est évident qu'il s'agit d'une activité extrêmement coûteuse. Et plus ces modèles dits "frontières" deviennent grands et performants, plus leur formation est coûteuse. Lorsqu'OpenAI a publié GPT-3 en 2020, le fournisseur de services cloud Lambda a estimé la formation du modèle, qui compte 175 millions de paramètres, a coûté plus de 4,6 millions de dollars à la société d'IA.

OpenAI n'a pas révélé la taille de GPT-4 et refuse de divulguer toute information à propos du modèle pour raisons commerciales et de concurrences. Mais certaines analyses suggèrent que GPT-4 compterait 1 000 à 1 800 milliards de paramètres et le PDG d'OpenAI, Sam Altman, a vaguement évalué le coût de l'entraînement à plus de 100 millions de dollars. Dario Amodei, cofondateur et PDG d'Anthropic, déclarait en août que des modèles coûtant plus d'un milliard de dollars apparaîtraient cette année et que d'ici 2025, nous pourrions avoir un modèle de 10 milliards de dollars. Amodei vient de revoir à la hausse cette estimation.

Lors d'une interview avec Bloomberg la semaine dernière, le PDG d'Anthopic a déclaré que la formation d'un modèle pourrait coûter jusqu'à 100 milliards de dollars dans un avenir proche. Il s'agit d'un investissement colossal que seules quelques entreprises pourraient être capables de supporter. Amodei a déclaré :

Citation Envoyé par Dario Amodei

La génération actuelle de modèles que nous voyons sur le marché est encore de l'ordre de 100 millions de dollars. Je pense que tout cela peut aller jusqu'à 100 milliards de dollars à l'extrémité de cette fourchette, avec quelques difficultés en matière de puissance et d'approvisionnement en puces. Mais nous y parviendrons dans quelques années.

C'est donc un facteur de mille de plus. Ensuite, je pense que les algorithmes deviendront plus efficaces et que nous verrons des choses, des choses qui s'ajouteront au post-entraînement. À un moment donné, nous n'en aurons plus. Mais je pense qu'il y a beaucoup de choses empilées pour continuer à améliorer les modèles.

Dario Amodei a cofondé Anthropic avec sa sœur Daniela en 2021. Autrefois chercheurs principaux chez OpenAI, les deux ont démissionné fin 2020 pour créer leur propre entreprise d'IA, avec l'objectif de construire des systèmes d'IA puissants et intelligents, mais aussi alignés sur les valeurs humaines. « Nous avons quitté OpenAI parce que nous étions préoccupés par la direction à prendre », a déclaré Daniela Amodei, présidente d'Anthropic, lors de l'interview.

Le coût de la formation pourrait bientôt devenir difficile à supporter pour les entreprises

Selon Dario Amodei, la puissance de calcul et les puces d'IA constitueront un facteur important de cette augmentation exponentielle des coûts. À titre de rappel, pour former leurs modèles d'IA, les entreprises s'appuient sur des unités de traitement graphique (GPU) capables de traiter de grandes quantités de données à grande vitesse. Non seulement ces puces sont rares, mais elles sont aussi extrêmement chères, les puces d'IA les plus avancées du marché étant principalement fabriquées par une seule entreprise : Nvidia. La demande des puces d'IA de Nvidia a rendu l'entreprise extrêmement riche ces dernières années.

Mais ce n'est pas tout. Amodei a ajouté : « il faut commencer à penser à l'écosystème plus large, aux compensations carbone pour les grands centres de données, et c'est ce que nous étudions également ». Cela suggère que les coûts de formation des modèles pourraient à l'avenir prendre en compte les dépenses liées aux efforts de compensation des émissions de dioxyde de carbone. L'IA est très vorace en énergie, tant pendant la formation que lors de l'inférence des modèles. La puissance de calcul nécessaire à l'IA contribue à une consommation d'énergie importante et à des émissions de dioxyde de carbone à grande échelle.

En 2022, des chercheurs du Royaume-Uni, des États-Unis, d'Allemagne et d'Espagne ont constaté que, après l'essor de l'apprentissage profond au début des années 2010, la puissance de calcul nécessaire pour former les nouveaux modèles les plus performants a doublé environ tous les six mois. Selon Jaime Sevilla, directeur d'Epoch AI et auteur principal de l'article, la trajectoire s'est maintenue depuis lors, le coût de la formation triplant environ chaque année. Elle a également déclaré que la multiplication par 4 des besoins en calcul est compensée par une augmentation de 1,3 fois de l'efficacité.

« C'est toujours une ligne droite et elle continue à pointer vers le haut », a ajouté Sevilla. Selon les analystes, si cette tendance se poursuit, le coût de la formation d'un modèle par rapport aux capacités acquises deviendra à un moment donné trop élevé pour être supporté par une entreprise. Par exemple, GPT-3 était plus précis que GPT-2, au point qu'il a pu alimenter le générateur de code GitHub Copilot. GPT-3.5, renforcé par des processus qui nécessitaient à nouveau une formation et des ressources informatiques supplémentaires, était suffisamment convaincant pour servir de base à la première version de ChatGPT.

Les difficultés liées à l'accès aux données pourraient augmenter les coûts de la formation

L'un des facteurs pouvant être un frein à l'évolution des capacités des modèles est la disponibilité des données pour la formation. Heim souligne qu'il existe plusieurs moyens pour contourner ce problème. (Par exemple, en s'entraînant sur un plus grand nombre de types de données et en montrant plusieurs fois les mêmes données aux modèles.) Les poursuites pour violation de droits d'auteur pourraient jouer un rôle dans l'équation, si elles empêchent les entreprises de s'emparer de toutes les données qu'elles peuvent trouver en ligne. Mais même si cela se produit, il y a toujours la possibilité d'utiliser des données synthétiques.

Ces données synthétiques comprennent, entre autres, des données vidéo générées par les moteurs de jeu Unity ou Unreal. D'autres proposent également d'utiliser des données générées par les modèles d'IA. En outre, il est probable que les entreprises accorderont de plus en plus de licences pour des données privées à des fins d'entraînement à l'IA. En outre, un autre risque réside dans l'aspect pratique de l'expansion des centres de données et de l'augmentation de la consommation d'énergie et d'eau qui en découle. Toutefois, l'opposition aux nouveaux grands centres de données s'accroît dans le monde.

« Nous pensons qu'à l'avenir, nous aurons bien sûr des modèles de base fermés, grands et solides, mais beaucoup d'entreprises adopteront de multiples petits modèles pour des cas d'utilisation spécifiques », a déclaré Philipp Schmid, responsable technique de la startup d'IA Hugging Face, ajoutant qu'une approche open source (comme l'ont fait des acteurs tels que Meta et Mistral) aiderait également à résoudre les problèmes de coûts. « Si nous nous appuyons sur le travail des uns et des autres, nous pouvons réutiliser les ressources et l'argent dépensés », a-t-il déclaré. Cependant, l'industrie est divisée sur cette question.

Lors d'une interview au début du mois, Sam Altman, PDG d'OpenAI, a déclaré qu'il ne se soucie pas du tout des sommes colossales dépensées par son entreprise pour développer des modèles d'IA plus avancés. Il a déclaré que le but est de construire l'intelligence artificielle générale (AGI) et que la fin justifie les moyens. Par conséquent, l'entrepreneur affirme qu'il se fiche de savoir si la construction de l'AGI va saigner jusqu'à 50 milliards de dollars par an. Lors de l'interview, Altman a également déclaré que le modèle GPT-4 d'OpenAI est la technologie la plus stupide que le monde aura à utiliser.

« Que nous brûlions 500 millions de d dollars, 5 milliards de dollars ou 50 milliards de dollars par an, cela m'est égal. Je m'en fiche vraiment tant que nous pouvons rester sur une trajectoire où nous créons finalement beaucoup plus de valeur pour la société que cela et tant que nous pouvons trouver un moyen de payer les factures. Nous sommes en train de créer l'AGI, et cela va coûter cher, mais cela en vaut vraiment la peine », a déclaré Altman lors de son apparition dans l'émission Stanford eCorner. Ses propos lui ont toutefois valu de nombreuses critiques dans la communauté.

Et vous ?

Quel est votre avis sur le sujet ?
Pensez-vous que la formation d'un modèle d'IA peut nécessiter 100 milliards de dollars ?
Une telle croissance exponentielle des coûts est-elle réaliste ? Ces dépenses permettront-elles d'atteindre l'AGI ?
Pourquoi les investisseurs injectent-ils autant d'argent dans les entreprises et les startups d'IA ?
Quelles pourraient être les conséquences sur l'économie mondiale si la bulle de l'IA finissait par éclater ?

Voir aussi

Sam Altman : « je me fiche de savoir si nous dépensons 50 milliards de dollars par an, nous construisons l'AGI et cela en vaudra la peine », ce montant dépasse largement le PIB de certains pays

L'IA sera-t-elle une catastrophe pour le climat ? Examens de ses répercussions environnementales, les outils d'IA, comme ChatGPT, sont reconnue comme énergivore

Une étude suggère que les outils d'IA de génération de texte et d'image émettent moins de CO2 que les humains pour les mêmes tâches, mais elle est controversée et divise les experts en IA
Vous avez lu gratuitement 34 609 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Artaeus
Nouveau Candidat au Club https://www.developpez.com
Le 24/09/2026 à 14:12
Un bien beau théâtre pour empêcher l'IA de dire des gros mots et de générer des deepfake car c'est "dangereux" ...
Tout en la mettant dans des missiles, tanks et de la surveillance de masse.

Hypocrisie à son maximum
7  0 
Avatar de kain_tn
Expert éminent https://www.developpez.com
Le 21/02/2026 à 13:44
Ah ouais, un "pays de génies".. Rien que ça...

Au pays des aveugles, les borgnes sont rois...
6  0 
Avatar de vVDB.fr
Membre régulier https://www.developpez.com
Le 25/01/2025 à 7:53
il n'y a aucune intelligence dans ces algorithmes probabilistes. C'est de la connaissance encyclopédique.

Par quel miracle ce gugus va-t-il supprimer les biais qui sont intrinsèques au système probabiliste ? Il parle d'un niveau doctorant, donc scientifiquement irréfutable.

L'intelligence ce n'est pas ce qui est le plus consensuel, attendu, probable, et surtout pas la moyenne !

A ce tarif, la terre serait toujours plate et vous seriez des hérétiques...

Le système sera intelligent lorsqu'il se posera la question de la cohérence des informations à chaque fois qu'on lui ingurgite une nouvelle donnée. l'IA ne doit pas bâtir une réponse sur des croyances. Les réponses ne peuvent être magiques comme aujourd'hui mais obligatoirement sourcées.

Que doit répondre une IA avec les données de l'an 800 à Charlemagne quand il lui pose la question : la terre, est-elle plate ?
- elle est bien plate (dogme de l'église)
- impossible de confirmer qu'elle est plate (hérétique).
- Ératosthène a montré qu'elle était sphérique (limite du blasphème pour Charlemagne)

Vous reprenez un jeu de questions aléatoires, avec une IA Afghane (uniquement alimentée avec des écritures saintes) ne devrait-elle pas donner les mêmes réponses qu'une IA athée ?

Quand Trump pose une question à une IA et que LA réponse ne lui convient pas : you're fired ? Et bien non, c'est pas comme ça la vrai vie pépère !

Nous sommes à des années lumières de l'intelligence supérieure promise par les Altman et consorts qui survendent de la proba pour de l'intelligence. J'ose : chatGPT est un simple Marmiton V2, une base de recettes.
5  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 16/09/2026 à 14:08
OpenAI, Anthropic et Google discutent depuis plusieurs semaines de la sécurité de l'IA, mais Trump qualifie ces préoccupations de canular
Trump ne s'est pas limité à parler de "canular"... Il a aussi ajouté qu'aucune règle limitant l'AI était nécessaire, un président américain "futé" suffit!

Je suppose que le "futé", c'est lui...
5  0 
Avatar de cobalt3d
Membre régulier https://www.developpez.com
Le 27/01/2025 à 4:21
Le mieux qu'on puisse attendre, c'est que l'Ia nous plonge dans un âge de stagnation et d'immobilisme. Elle ne fait que simuler l'intelligence. Sans modèle, elle n'invente rien. Elle n'inventera jamais rien. Pire, si la moindre originalité devait apparaître quelque part, c'est qu'elle l'aura volé dans une publication obscure qui aura échappé au plus grand nombre. Même cette situation est peu probable. L'enthousiasme et l'optimisme actuels ne sont destinés qu'à gonfler la bulle spéculative qui l'entoure.
4  0 
Avatar de CosmoKnacki
Expert éminent https://www.developpez.com
Le 25/02/2026 à 20:27
En même temps s'il ose dire une aussi grosse ânerie, c'est qu'il est bien conscient qu'il y a dans ce monde suffisamment d'imbéciles pour le croire.
4  0 
Avatar de Artaeus
Nouveau Candidat au Club https://www.developpez.com
Le 14/09/2026 à 17:51
Si un PDG d'une entreprise leader appelle à de la "régulation", c'est qu'il a peur de ses concurrents.
5  1 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 16/09/2026 à 14:04
« Nous n'avons pas besoin de nouvelles lois ni de réglementations sur l'IA, laissez-nous nous occuper de la sécurité », déclare Jensen Huang, PDG de Nvidia
Autrement dit "Supprimons les corps de pompiers, cela fera des économies pour les Etats endettés comme la France... Les pyromanes et les ado qui jouent avec les allumettes en mettant le feu aux granges sauront parfaitement s'occuper de la défense anti-incendie!"

Ces connards qui gèrent les géants de la techno américains sont vraiment des abrutis, imbus d'eux-même et cons comme des balais!
4  0 
Avatar de urumaru
Membre régulier https://www.developpez.com
Le 24/09/2026 à 15:21
Tout ce foin savamment orchestré pour en fait ralentir les concurrents étrangers...

Quand on voit les "pseudos" braking news qui "informent" que tel agent IA de telle boite a réussi tel exploit, j'aimerais bien avoir les instructions qui ont été données à cet agent IA pour mener les fameux piratages.

Cela met surtout en lumière la "qualité" des développements informatiques opérés par les États (ou plutôt les gouvernements) qui n'ont fait l'objet d'aucune évaluation sérieuse sur l'architecture et la robustesse du code.

alors quant au post quantique...

quand on ne veut pas qu'un agent atteigne internet, on l'installe sur un réseau fermé sans aucune connexion externe, c'est simple non ?

Dans le cas contraire, on demande à un autre agent IA d’empêcher tel agent IA d'aller sur internet, dans un réseau fermé qui dispose d'un pseudo internet, ça devrait être possible à simuler avec leurs datacenters de ouf.

enfin bref, un battage pour faire peur à la ménagère : à la fin des fins, c'est une question de responsabilité.

ces entreprises, sous couvert de pseudo perte de contrôle, essaient de se dédouaner de leurs responsabilités, surtout en cas de conflits dans lesquels des civils seraient tués à cause de leur technologie (cf école en iran).

rien que pour cela, ils devraient être poursuivis et recadrés sévèrement.

Je suis certain qu'avec une menace de prison à vie (ou de 200 ans de prison, c'est possible aux US), le contrôle serait subitement possible...
4  0 
Avatar de Artaeus
Nouveau Candidat au Club https://www.developpez.com
Le 28/09/2026 à 17:19
Attention, votre LLM pourrait vous tuer en disant des gros mots ...
Par contre, aucun commentaire sur les IAs dans des drones kamikazes ou la surveillance de masse par nos gouvernements qui n'est absolument pas dangereuse ?
4  0