IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

La start-up chinoise spécialisée dans l'IA DeepSeek a annoncé qu'elle réduisait définitivement de 75 % le prix de son modèle phare, le V4-Pro, proposant un prix au moins 34 fois inférieur à celui du GPT-5.5

Le , par Jade Emy

377PARTAGES

6  0 
La start-up chinoise spécialisée dans l'IA DeepSeek a annoncé qu'elle réduisait définitivement le prix de son modèle phare V4-Pro de 75 %. Dans le cadre de cette réduction permanente, un million de jetons d'entrée sans cache ne coûte que 0,435 $, tandis qu'un million de jetons de sortie coûte 0,87 $. À titre de comparaison, GPT 5.5 facture 5 $ par million de jetons d'entrée et 30 $ par million de jetons de sortie, tandis qu'Opus 4.7 se situe à 5 $ pour l'entrée et 25 $ pour la sortie. Cela rend le produit phare de Deepseek environ 11,5 fois moins cher que GPT 5.5 sur la tarification standard des entrées. Les raisons économiques derrière la remise de 75 % de DeepSeek pourraient être liées à la guerre commerciale géopolitique en cours concernant les semi-conducteurs de pointe. Alors que les restrictions américaines visaient à ralentir les progrès de la Chine en matière d'IA, elles ont eu l'effet inverse : elles ont créé un boom massif et exclusif du marché pour le plus grand concurrent national de Nvidia, Huawei.

DeepSeek est une entreprise chinoise spécialisée dans l'intelligence artificielle (IA) qui développe des grands modèles de langage (LLM). La société a lancé un chatbot éponyme parallèlement à son modèle DeepSeek-R1 en janvier 2025. DeepSeek-R1 fournissait des réponses comparables à celles d'autres LLM contemporains, tels que le GPT-4 et l'o1 d'OpenAI. Son coût de formation aurait été nettement inférieur à celui d'autres LLM. La société affirme avoir formé son modèle V3 pour 6 millions de dollars, soit bien moins que les 100 millions de dollars qu'a coûté le GPT-4 d'OpenAI en 2023, et en utilisant environ un dixième de la puissance de calcul consommée par le modèle comparable de Meta, Llama 3.1. Le succès de DeepSeek face à des rivaux plus importants et mieux établis a été qualifié de « bouleversement de l'IA ».

En avril 2026, DeepSeek a lancé DeepSeek V4 Pro et DeepSeek V4 Flash, sa première mise à jour majeure de modèle depuis plus d'un an. Les nouveaux modèles V4 introduisent une fenêtre contextuelle pouvant atteindre 1 million de jetons, ce qui permet de maintenir une meilleure cohérence dans les conversations et les documents plus longs, à moindre coût. DeepSeek V4 reste open source, ce qui permet aux utilisateurs d'inspecter, d'adapter ou de modifier le code. V4 Pro est destiné à des tâches agentiques plus complexes en plusieurs étapes. DeepSeek affirme qu'il rivalise avec les principaux modèles propriétaires en matière de raisonnement et qu'il n'est devancé que par Gemini 3.1 Pro de Google en termes de connaissance du monde. V4 Flash est la variante plus rapide, offrant des réponses plus rapides tout en restant proche de V4 Pro pour les tâches agentiques plus simples.

Récemment, la start-up chinoise spécialisée dans l'IA DeepSeek a annoncé qu'elle réduisait définitivement le prix de son modèle phare V4-Pro de 75 %. Cette baisse de prix massive ramène le coût d'utilisation de l'outil logiciel le plus puissant de DeepSeek à seulement un quart de son tarif initial. Bien que DeepSeek n'ait pas explicitement précisé ce qui lui a permis de baisser ses prix de manière aussi drastique, on suppose que la disponibilité aisée des puces Huawei pourrait être à l'origine de cette baisse.

Il convient de noter que lorsque DeepSeek a lancé V4, l'entreprise avait déclaré que la version Pro coûterait jusqu'à 12 fois plus cher que la version Flash, moins puissante, en raison de « contraintes liées à la capacité de calcul haut de gamme », limitant ainsi la disponibilité. Ainsi, le prix de la version Pro devrait baisser fortement une fois que les supernœuds Huawei Ascend 950 seront lancés en grande quantité au cours du second semestre.


DeepSeek « fait chuter » le marché des tokens

Les raisons économiques derrière la remise de 75 % de DeepSeek pourraient être liées à la guerre commerciale géopolitique en cours concernant les semi-conducteurs de pointe. Les contrôles stricts des exportations américains empêchent actuellement Nvidia de vendre ses processeurs graphiques (GPU) d'IA haut de gamme à des entreprises chinoises. Alors que ces restrictions américaines visaient à ralentir les progrès de la Chine en matière d'IA, elles ont eu l'effet inverse : elles ont créé un boom massif et exclusif du marché pour le plus grand concurrent national de Nvidia, Huawei.

DeepSeek s'appuie fortement sur les puces Ascend 950 développées en interne par Huawei pour alimenter et optimiser les performances de ses modèles V4. En optimisant son logiciel pour qu'il fonctionne sur des puces chinoises locales plutôt que de dépendre du matériel Nvidia, coûteux, soumis à des restrictions ou disponible au marché noir, DeepSeek a pu réduire considérablement ses coûts d'infrastructure opérationnelle.

Selon un communiqué officiel de la société, DeepSeek a réduit les coûts de son interface de programmation d'applications (API) pour le modèle V4-Pro à un montant compris entre 0,025 et 6 yuans par million de tokens, en fonction du type de déploiement. Auparavant, ces mêmes charges de travail coûtaient aux développeurs entre 0,1 et 24 yuans. Dans le secteur de l’IA, un « token » est une fraction de mot ou une unité de texte traitée par un grand modèle de langage. En ramenant le coût des tokens à une fraction de centime, DeepSeek vise à devancer à la fois ses concurrents nationaux et les entreprises occidentales d’IA, rendant l’intégration avancée de l’IA incroyablement bon marché pour les développeurs de logiciels.


Dans le cadre de cette réduction permanente, un million de jetons d'entrée sans cache ne coûte que 0,435 $, tandis qu'un million de jetons de sortie coûte 0,87 $. Les accès au cache font baisser encore davantage le prix d'entrée. À titre de comparaison, GPT 5.5 facture 5 $ par million de jetons d'entrée et 30 $ par million de jetons de sortie, tandis qu'Opus 4.7 se situe à 5 $ pour l'entrée et 25 $ pour la sortie. Cela rend le produit phare de Deepseek environ 11,5 fois moins cher que GPT 5.5 sur la tarification standard des entrées. L'écart est bien plus important en sortie, où Deepseek V4 Pro est environ 34,5 fois moins cher. Par rapport à la tarification de GPT 5.5 pour les contextes longs de plus de 272 000 tokens, Deepseek V4 Pro est environ 23 fois moins cher en entrée et environ 51,7 fois moins cher en sortie. Deepseek V4 Flash est encore moins cher.

Le prix brut par token n'est toutefois qu'une partie du tableau. La consommation de tokens par tâche est tout aussi importante. C'est un peu comme le prix de l'essence : un prix bas au litre ne sert à rien si votre moteur consomme beaucoup de carburant. Gemini Flash 3.5 de Google en est un bon exemple. Sur le papier, il est moins cher et offre des performances similaires à celles du modèle Pro 3.1 précédent, mais il consomme beaucoup plus de tokens, ce qui le rend potentiellement plus coûteux dans la pratique. Le modèle Opus 4.7 d'Anthropic semble lui aussi moins cher sur le papier que le GPT-5.5, mais il utilise plus de jetons que son prédécesseur. Le GPT-5.5, en revanche, consomme moins de jetons que le GPT-5.4. Pourtant, ces deux modèles se sont avérés 30 à 90 % plus chers que les modèles qu'ils ont remplacés.

Deepseek V4 est clairement à la traîne par rapport aux modèles de pointe GPT-5.5 et Opus 4.7 en termes de performances brutes. L'écart exact dépend de la tâche, et les benchmarks ne reflètent qu'une partie de la réalité ; seule l'utilisation en conditions réelles permettra de se prononcer. Mais l'écart de prix est considérable, en particulier pour les systèmes d'IA agentique qui consomment plusieurs fois plus de tokens qu'un chatbot standard. Et à mesure que l'utilisation de l'IA se généralise, les entreprises deviennent plus sensibles aux prix. Tant que le retour sur investissement des dépenses en IA restera difficile à mesurer, de nombreuses entreprises pourraient changer de stratégie : elles délaisseraient le meilleur modèle au profit du moins cher qui reste néanmoins suffisamment performant.


Voici un extrait de l'annonce de Deepseek :

API DeepSeek V4 Pro : la réduction de 75 % devient permanente

DeepSeek a rendu permanente la réduction de prix temporaire de 75 % appliquée à son API V4 Pro. Cette décision place DeepSeek V4 Pro en position de force sur la frontière de Pareto entre l'indice d'intelligence et le coût d'exploitation de l'intelligence, où il figure aux...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Pierre Louis Chevalier
Expert éminent sénior https://www.developpez.com
Le 08/08/2026 à 15:11
Il faut bien payer les data center quand c'est du cloud. Ceci dit il y a quand même une forte différence entre la chine et les US.

1) Le développement de modèles performantes en Chine n'a couté que quelques centaines de milliers de dollars contre plus de 100 milliards aux US, d'après les US les chinois aurait cloné les meilleur LLM US par distillation.
Enfin n'oublions pas que le code de Claude d'Anthropic à fuité donc il est dans la nature.
Par conséquent les chinois n'ont pas besoin d'inclure dans leur prix le remboursement plus de 100 milliard d'investissement.

2) Les chinois sont a même de construire et de faire tourner des centres de données certainement pour moins de 50% du prix des US, par conséquent rien que pour cette raison il pourront toujours être bien moins cher que les US.

3) Les US sont dans une situation énergétique catastrophique, ayant stoppé les programmes de constructions de centrales nucléaires, et Trump ayant trouvé ça amusant de bloquer les autorisations de sites d'Eoliennes aux US, les USA en sont réduits à alimenter leur data centers avec des centrales a charbon et des turbines à gaz, ce qui est un désastre écologique total.
Pendant ce temps la chine a développé un énorme programme de création d'électricité décarboné avec des centrales nucléaires et des parcs solaires et éoliens énormes, une magnifique prouesse.

Donc au final, la chine sera toujours en mesure de proposer de L'IA cloud bien moins chère que les US, et il n'y a pas besoin d'être un grand génie de la finance pour comprendre que les milliards investis par les spéculateurs dans les sociétés IA LLM ne seront jamais remboursés et qu'un écroulement total de la bulle IA US peut arriver à tout moment, déjà le titre Space X s'est écroulé entre autres parce que Grok fait un Bide, et des financiers ont décidé de Shorter le titre Oracle qui s'est lourdement endetté à cause de l'IA et qui devrait donc d'après eu s'écrouler lamentablement.

Tout ne va pas d'écrouler, cela prendra des années pour mettre en place des usines pour concurrencer NVIDIA et d'autres fabricants de puces, qui vont donc continuer à vendre leurs puces à prix forts, et il n'y a aucune raison que l'éclatement de la bulle IA US touche les sociétés d'IA chinoises vu qu'au final c'est la Chine qui va rafler le marché global.
4  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 07/08/2026 à 17:19
Que l'IA soit américaine ou chinoise, tous utilisent la même stratégie marketing:

1° On rase d'abord gratis: Gratuité pour attirer les clients

2° Une fois que les clients sont captifs, la gratuité laisse place à la facturation!!!

Que le modèle économique soit américain ou chinois, l'objectif d'une entreprise est de faire de l'argent!!!

---

Et n'oubliez pas un point important: Si un service reste gratuit dans la durée, cela signifie que c'est vous le produit qui est vendu... Vous et vos données personnelles!!!
4  1 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 17/08/2026 à 17:01
Quand l'IA était "gratuite", c'était "open bar, aujourd'hui on rase gratis!", on mettait de l'IA partout

Mais quand il va falloir revenir à la réalité et payer réellement ce que coûte l'IA, les ardeurs à généraliser l'IA jusque dans la cuvette des WC vont se calmer...

Et l'IA va se limiter plus qu'à quelques usages: Là où l'IA a fait ses preuves, là où l'IA rapporte plus que ce qu'elle coûte!!!
2  0 
Avatar de jnspunk
Membre habitué https://www.developpez.com
Le 08/08/2026 à 5:39
On a de la chance d'avoir des modèles qui tournent en local gratos, si toutefois on a eu la chance de se procurer du matériel avant la montée des prix.
1  0 
Avatar de der§en
Membre expérimenté https://www.developpez.com
Le 08/08/2026 à 11:55
La phase de dumping des chinois est terminée, maintenant il va falloir passer à la caisse, plus cela change, moins cela change avec eux…
1  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 09/08/2026 à 8:47
Citation Envoyé par OrthodoxWindows Voir le message
Il faut distinguer gratuit et open-source, ainsi que quels sont les éléments open-source
On ne parle pas de la même chose: Pour moi, quand on parle de déploiement "local", on parle d'une IA qui n'est pas connectée à internet!!!

Que votre IA soir "open-source" ou pas, cela ne change rien... Il n'y a pas un seul utilisateur d'un quelconque logiciel "open-source" qui a vérifié ce que faisait effectivement le code du logiciel qu'il utilise. Affirmer le contraire serait tout simplement mentir!

Donc rien n'empêche votre IA "open-source" connectée de "s'échapper" de votre usage "locale" et de transmettre vos données à des tiers...

Votre IA "locale" déployée dans une infrastructure connectée n'est pas locale!
1  0 
Avatar de der§en
Membre expérimenté https://www.developpez.com
Le 25/05/2026 à 15:24
Un grand classique pour casser les reins à la concurrence : le dumping 🤮
1  1 
Avatar de OrthodoxWindows
Membre expert https://www.developpez.com
Le 08/08/2026 à 22:20
Citation Envoyé par Anselme45 Voir le message
Et vos modèles deviendront très vite obsolètes puisque ne profitant pas des nouvelles versions devenues... Payantes!
Il faut distinguer gratuit et open-source, ainsi que quels sont les éléments open-source.
Un modèle open-source est, comme sont nom l'indique, de source ouverte, et peut donc être déployé en local. La majorité des modèles open-source sont publiés sous licence permissive MIT, à l’exception de quelques modèles (surtout de Meta et de Stable Diffusion) publiés sous une licence restrictive faussement open-source.
Cependant, rare sont les données et méthode d’entraînement open-source. En pratique, cela signifie qu'un contrôle est laissé à l'utilisateur pour utiliser le modèle, et le finetuner, enlever telle ou telle censure... Mais l'utilisateur n'ayant pas le contrôle sur comment le modèle à été entraîné, il ne peut pas modifier son comportement global, car un LLM fonctionne avant tout par ses données d’entraînement, c'est le principe même d'un LLM.

Quand à la question de savoir si les entreprises ayant une politique d'open-source continueront à avoir cette politique, rien ne porte à penser qu'à court terme, cela changera, vu que les modèles d'open-source tendent plutôt à se multiplier.
A plus long terme, il est délicat de prédire, cela dépendra de la rentabilité du modèle économique actuel... Je partage l'avis de Pierre Louis Chevalier, les chinois semblent clairement viser une domination mondial dans les LLM, et semblent bien parti pour y parvenir.

Et dans le pire des cas, il ne faut pas oublier que de la même manière que les chinois ont utilisés la distillation pour développer leurs LLMs, de future communautés FOSS pourront probablement faire la même chose. Des universitaires sont d'ailleurs déjà parvenu à construire des LLMs assez performant pour un prix particulièrement peu élevé.
1  1 
Avatar de Fagus
Membre expert https://www.developpez.com
Le 12/08/2026 à 10:19
Citation Envoyé par Anselme45 Voir le message
re IA "open-source" connectée de "s'échapper" de votre usage "locale" et de transmettre vos données à des tiers...

Votre IA "locale" déployée dans une infrastructure connectée n'est pas locale!
Toutes les IA n'ont pas la capacité de faire un sandbox escape. Déjà, une IA locale, c'est souvent un modèle plus petit voire un tout petit modèle spécialisé dans une tâche. Si je veux créer un livre bilingue, un petit LLM spécialisé en traduction qui tourne en CPU fera l'affaire. Si je veux transcrire des heures d'audio pareil, même en CPU.

Même les grosses IA locales, si dans leur sandbox, elles n'ont aucun outil de hacking et même pas toutes les commandes linux de base (pas installé et commandes whitelistées), elles vont avoir du mal à sortir. Les histoires d'IA sorties de leur boîte chez anthropic, c'était des IA agentiques offensives dotées d'un arsenal logiciel offensif.
Je veux bien croire que le LLM est très fort, mais s'il n'a pas le réseau, pas le droit de lire autre chose que le répertoire de dév, accès seulement aux commandes de dév dans une sandbox, pas d'accès en écriture au système de fichier (écriture dans un FS overlay dans un container), à un moment c'est comme un champion de l'évasion à poil dans un coffre fort vide.
0  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 08/08/2026 à 11:44
Citation Envoyé par jnspunk Voir le message
On a de la chance d'avoir des modèles qui tournent en local gratos, si toutefois on a eu la chance de se procurer du matériel avant la montée des prix.
Et vos modèles deviendront très vite obsolètes puisque ne profitant pas des nouvelles versions devenues... Payantes!
1  2