IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

DeepSeek dévoile un aperçu de son modèle V4 tant attendu, qui offre un contexte d'un million de jetons et d'excellents résultats en matière de codage
Mettant la pression sur l'ensemble du marché de l'IA

Le , par Jade Emy

297PARTAGES

4  0 
DeepSeek a lancé DeepSeek V4 Pro et DeepSeek V4 Flash, sa première mise à jour majeure de modèle depuis plus d'un an. Les nouveaux modèles V4 introduisent une fenêtre contextuelle pouvant atteindre 1 million de jetons, ce qui permet de maintenir une meilleure cohérence dans les conversations et les documents plus longs, à moindre coût. DeepSeek V4 reste open source, ce qui permet aux utilisateurs d'inspecter, d'adapter ou de modifier le code. Son précédent modèle R1 avait bouleversé les marchés grâce à ses performances élevées à moindre coût. La concurrence chinoise croissante a intensifié la pression sur les stratégies mondiales en matière de dépenses dans l'IA.

DeepSeek est une entreprise chinoise spécialisée dans l'intelligence artificielle (IA) qui développe des grands modèles de langage (LLM). La société a lancé un chatbot éponyme parallèlement à son modèle DeepSeek-R1 en janvier 2025. DeepSeek-R1 fournissait des réponses comparables à celles d'autres LLM contemporains, tels que le GPT-4 et l'o1 d'OpenAI. Son coût de formation aurait été nettement inférieur à celui d'autres LLM. La société affirme avoir formé son modèle V3 pour 6 millions de dollars, soit bien moins que les 100 millions de dollars qu'a coûté le GPT-4 d'OpenAI en 2023, et en utilisant environ un dixième de la puissance de calcul consommée par le modèle comparable de Meta, Llama 3.1. Le succès de DeepSeek face à des rivaux plus importants et mieux établis a été qualifié de « bouleversement de l'IA ».

Récemment, DeepSeek a lancé DeepSeek V4 Pro et DeepSeek V4 Flash, sa première mise à jour majeure de modèle depuis plus d'un an. Les nouveaux modèles V4 introduisent une fenêtre contextuelle pouvant atteindre 1 million de jetons, ce qui permet de maintenir une meilleure cohérence dans les conversations et les documents plus longs, à moindre coût. DeepSeek V4 reste open source, ce qui permet aux utilisateurs d'inspecter, d'adapter ou de modifier le code. V4 Pro est destiné à des tâches agentiques plus complexes en plusieurs étapes. DeepSeek affirme qu'il rivalise avec les principaux modèles propriétaires en matière de raisonnement et qu'il n'est devancé que par Gemini 3.1 Pro de Google en termes de connaissance du monde. V4 Flash est la variante plus rapide, offrant des réponses plus rapides tout en restant proche de V4 Pro pour les tâches agentiques plus simples.

Cette sortie intervient également dans un contexte de surveillance accrue. L'utilisation de DeepSeek a été interdite par les agences fédérales américaines et sur les appareils gouvernementaux pour des raisons de sécurité nationale, tandis que la Corée du Sud a temporairement suspendu les téléchargements pour des raisons de confidentialité avant de rétablir la disponibilité par la suite.


DeepSeek dévoile une version préliminaire de son modèle V4 tant attendu

La start-up chinoise spécialisée dans l'IA DeepSeek a publié une version préliminaire de son très attendu modèle V4, permettant aux utilisateurs de tester ses nouvelles capacités et fonctionnalités. Cette sortie intervient plus d'un an après que la société basée à Hangzhou a présenté son modèle de raisonnement R1, qui a bouleversé les marchés technologiques mondiaux en raison de ses performances surprenantes et de sa rentabilité.

À l'instar des précédentes versions de DeepSeek, cette dernière mise à jour est open source, ce qui permet aux développeurs de télécharger le code, de l'exécuter localement et, dans la plupart des cas, de le modifier. Le modèle est disponible en versions « pro » et « flash », en fonction de la taille, DeepSeek affirmant que le V4 offre des performances supérieures à celles de ses concurrents nationaux, notamment dans les tâches basées sur des agents, le traitement des connaissances et l'inférence.

« L'aperçu de la V4 de DeepSeek est une véritable prouesse », offrant des coûts d'inférence inférieurs à ceux des modèles précédents, a déclaré Neil Shah, vice-président de la recherche chez Counterpoint Research. Les coûts d'inférence désignent les dépenses informatiques et financières liées à l'exécution d'un modèle d'IA entraîné pour générer des résultats. DeepSeek a également indiqué que la V4 a été optimisée pour être utilisée avec des outils d'agents populaires tels que Claude Code d'Anthropic et OpenClaw. Selon Wei Sun, analyste principal en IA chez Counterpoint, le profil de référence de la V4 suggère qu’elle pourrait offrir « d’excellentes capacités d’agent à un coût nettement inférieur ».


DeepSeek va-t-il à nouveau surprendre le monde ?

Fondée en 2023, DeepSeek s’est fait remarquer fin 2024 avec son modèle V3 gratuit et open source, qui, selon l’entreprise, avait été entraîné avec des puces moins puissantes et à un coût bien inférieur à celui des modèles développés par des sociétés telles qu’OpenAI et Google. Quelques semaines plus tard, en janvier 2025, l’entreprise a lancé un modèle de raisonnement, R1, qui a atteint des performances similaires ou surpassé bon nombre des principaux modèles de langage (LLM) mondiaux.

Le modèle R1 avait alarmé les investisseurs lorsque DeepSeek avait révélé qu’il n’avait fallu que deux mois, et moins de 6 millions de dollars, pour le développer à l’aide de puces Nvidia de moindre capacité. Cela avait remis en question la suprématie des États-Unis en matière d’IA ainsi que les dépenses colossales des géants de la tech dans les infrastructures d’IA. Depuis lors, DeepSeek a publié une série de mises à jour de ses modèles, mais aucune n’a eu l’impact de R1.

Le lancement de V4 n’aura probablement pas le même impact sur le marché que celui de R1, car les traders ont déjà intégré dans leurs prévisions le fait que l’IA chinoise est compétitive et moins coûteuse à utiliser, a déclaré Ivan Su, analyste actions senior chez Morningstar. Cependant, le dernier positionnement de DeepSeek place d’autres modèles open source chinois en tant que concurrents directs, a ajouté Su. « C'est un cadre qui n'existait pas avec R1, et cela suffit à montrer à quel point la concurrence nationale s'est intensifiée », a-t-il ajouté.

Depuis la sortie de R1, DeepSeek a dû faire face à une concurrence accrue dans le secteur chinois de l'IA en plein essor, des acteurs comme Alibaba et ByteDance ayant également lancé de nouveaux modèles cette année. Les actions de plusieurs autres acteurs chinois de l’IA étaient en baisse à la Bourse de Hong Kong. MiniMax et Knowledge Atlas Technology, également connu sous le nom de Zhipu, ont chacune chuté d’environ 8 %, tandis que le développeur Manycore Tech, basé à Hangzhou, a plongé de 9 %.


Quelles puces ont servi à entraîner le V4 ?

Une question majeure entourant la sortie du modèle V4 de DeepSeek est de savoir quelles puces ont été utilisées pour l’entraîner et le prendre en charge. Le géant technologique chinois Huawei a confirmé vendredi que son dernier cluster de calcul IA, équipé de ses processeurs Ascend AI, peut prendre en charge le modèle V4 de DeepSeek. Cependant, on ignore encore dans quelle mesure les puces de Huawei ont été utilisées pour l'entraînement, par rapport à celles du leader américain des puces IA, Nvidia. Les développeurs chinois se sont vu interdire l'achat direct des puces IA les plus avancées de Nvidia en raison des contrôles à l'exportation sans cesse changeants de Washington.

Dans le même temps, Pékin a intensifié ses efforts pour développer son industrie nationale des puces et aurait incité les entreprises technologiques chinoises à adopter des alternatives nationales proposées par des fabricants de puces tels que Huawei. Wei Sun, de Counterpoint, a déclaré que la capacité de V4 à fonctionner en mode natif sur des puces locales pourrait avoir des implications considérables, aidant Pékin à renforcer sa souveraineté en matière d’IA et à réduire davantage sa dépendance vis-à-vis de Nvidia. « Cela finira également par accélérer les développements mondiaux en matière d’IA », a-t-elle ajouté.

Après l'annonce par DeepSeek de la sortie de V4, les actions des fabricants chinois de puces sous contrat ont progressé à Hong Kong, SMIC et Hua Hong Semiconductor enregistrant respectivement une hausse de 9 % et 15 %. Depuis fin décembre 2025, les modèles d'IA open source chinois ont considérablement étendu leur présence à l'échelle mondiale, leur taux d'adoption passant de 13 % à près de 30 % de l'utilisation totale en 2025, principalement grâce à Qwen et DeepSeek. Cette tendance a été documentée dans le rapport "State of AI" d'OpenRouter, qui a analysé plus de 100 000 milliards de jetons sur plus de 300 modèles, révélant ainsi le passage d'une domination propriétaire à une concurrence pluraliste et open source à l'échelle mondiale.

Source : Annonce de DeepSeek V4

Et vous ?

Pensez-vous que cette étude est crédible ou pertinente ?
Quel est votre avis sur le sujet ?

Voir aussi :

DeepSeek, la start-up chinoise spécialisée dans l'IA qui a fait perdre près de 600 milliards $ à Nvidia en une seule journée avec le lancement de son modèle R1, s'apprête à dévoiler son prochain modèle d'IA

Le mystérieux modèle d'IA « Hunter Alpha », que l'on croyait être DeepSeek V4, s'avère être une création de Xiaomi, doté de caractéristiques techniques impressionnantes avec 1 000 milliards de paramètres

Les États-Unis accusent la Chine de voler leur IA « à l'échelle industrielle » via la technique de distillation : Pékin dénonce une « calomnie » et DeepSeek, visé implicitement, publie son modèle V4
Vous avez lu gratuitement 3 055 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Pierre Louis Chevalier
Expert éminent sénior https://www.developpez.com
Le 08/08/2026 à 15:11
Il faut bien payer les data center quand c'est du cloud. Ceci dit il y a quand même une forte différence entre la chine et les US.

1) Le développement de modèles performantes en Chine n'a couté que quelques centaines de milliers de dollars contre plus de 100 milliards aux US, d'après les US les chinois aurait cloné les meilleur LLM US par distillation.
Enfin n'oublions pas que le code de Claude d'Anthropic à fuité donc il est dans la nature.
Par conséquent les chinois n'ont pas besoin d'inclure dans leur prix le remboursement plus de 100 milliard d'investissement.

2) Les chinois sont a même de construire et de faire tourner des centres de données certainement pour moins de 50% du prix des US, par conséquent rien que pour cette raison il pourront toujours être bien moins cher que les US.

3) Les US sont dans une situation énergétique catastrophique, ayant stoppé les programmes de constructions de centrales nucléaires, et Trump ayant trouvé ça amusant de bloquer les autorisations de sites d'Eoliennes aux US, les USA en sont réduits à alimenter leur data centers avec des centrales a charbon et des turbines à gaz, ce qui est un désastre écologique total.
Pendant ce temps la chine a développé un énorme programme de création d'électricité décarboné avec des centrales nucléaires et des parcs solaires et éoliens énormes, une magnifique prouesse.

Donc au final, la chine sera toujours en mesure de proposer de L'IA cloud bien moins chère que les US, et il n'y a pas besoin d'être un grand génie de la finance pour comprendre que les milliards investis par les spéculateurs dans les sociétés IA LLM ne seront jamais remboursés et qu'un écroulement total de la bulle IA US peut arriver à tout moment, déjà le titre Space X s'est écroulé entre autres parce que Grok fait un Bide, et des financiers ont décidé de Shorter le titre Oracle qui s'est lourdement endetté à cause de l'IA et qui devrait donc d'après eu s'écrouler lamentablement.

Tout ne va pas d'écrouler, cela prendra des années pour mettre en place des usines pour concurrencer NVIDIA et d'autres fabricants de puces, qui vont donc continuer à vendre leurs puces à prix forts, et il n'y a aucune raison que l'éclatement de la bulle IA US touche les sociétés d'IA chinoises vu qu'au final c'est la Chine qui va rafler le marché global.
4  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 07/08/2026 à 17:19
Que l'IA soit américaine ou chinoise, tous utilisent la même stratégie marketing:

1° On rase d'abord gratis: Gratuité pour attirer les clients

2° Une fois que les clients sont captifs, la gratuité laisse place à la facturation!!!

Que le modèle économique soit américain ou chinois, l'objectif d'une entreprise est de faire de l'argent!!!

---

Et n'oubliez pas un point important: Si un service reste gratuit dans la durée, cela signifie que c'est vous le produit qui est vendu... Vous et vos données personnelles!!!
4  1 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 17/08/2026 à 17:01
Quand l'IA était "gratuite", c'était "open bar, aujourd'hui on rase gratis!", on mettait de l'IA partout

Mais quand il va falloir revenir à la réalité et payer réellement ce que coûte l'IA, les ardeurs à généraliser l'IA jusque dans la cuvette des WC vont se calmer...

Et l'IA va se limiter plus qu'à quelques usages: Là où l'IA a fait ses preuves, là où l'IA rapporte plus que ce qu'elle coûte!!!
2  0 
Avatar de jnspunk
Membre habitué https://www.developpez.com
Le 08/08/2026 à 5:39
On a de la chance d'avoir des modèles qui tournent en local gratos, si toutefois on a eu la chance de se procurer du matériel avant la montée des prix.
1  0 
Avatar de der§en
Membre expérimenté https://www.developpez.com
Le 08/08/2026 à 11:55
La phase de dumping des chinois est terminée, maintenant il va falloir passer à la caisse, plus cela change, moins cela change avec eux…
1  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 09/08/2026 à 8:47
Citation Envoyé par OrthodoxWindows Voir le message
Il faut distinguer gratuit et open-source, ainsi que quels sont les éléments open-source
On ne parle pas de la même chose: Pour moi, quand on parle de déploiement "local", on parle d'une IA qui n'est pas connectée à internet!!!

Que votre IA soir "open-source" ou pas, cela ne change rien... Il n'y a pas un seul utilisateur d'un quelconque logiciel "open-source" qui a vérifié ce que faisait effectivement le code du logiciel qu'il utilise. Affirmer le contraire serait tout simplement mentir!

Donc rien n'empêche votre IA "open-source" connectée de "s'échapper" de votre usage "locale" et de transmettre vos données à des tiers...

Votre IA "locale" déployée dans une infrastructure connectée n'est pas locale!
1  0 
Avatar de der§en
Membre expérimenté https://www.developpez.com
Le 25/05/2026 à 15:24
Un grand classique pour casser les reins à la concurrence : le dumping 🤮
1  1 
Avatar de OrthodoxWindows
Membre expert https://www.developpez.com
Le 08/08/2026 à 22:20
Citation Envoyé par Anselme45 Voir le message
Et vos modèles deviendront très vite obsolètes puisque ne profitant pas des nouvelles versions devenues... Payantes!
Il faut distinguer gratuit et open-source, ainsi que quels sont les éléments open-source.
Un modèle open-source est, comme sont nom l'indique, de source ouverte, et peut donc être déployé en local. La majorité des modèles open-source sont publiés sous licence permissive MIT, à l’exception de quelques modèles (surtout de Meta et de Stable Diffusion) publiés sous une licence restrictive faussement open-source.
Cependant, rare sont les données et méthode d’entraînement open-source. En pratique, cela signifie qu'un contrôle est laissé à l'utilisateur pour utiliser le modèle, et le finetuner, enlever telle ou telle censure... Mais l'utilisateur n'ayant pas le contrôle sur comment le modèle à été entraîné, il ne peut pas modifier son comportement global, car un LLM fonctionne avant tout par ses données d’entraînement, c'est le principe même d'un LLM.

Quand à la question de savoir si les entreprises ayant une politique d'open-source continueront à avoir cette politique, rien ne porte à penser qu'à court terme, cela changera, vu que les modèles d'open-source tendent plutôt à se multiplier.
A plus long terme, il est délicat de prédire, cela dépendra de la rentabilité du modèle économique actuel... Je partage l'avis de Pierre Louis Chevalier, les chinois semblent clairement viser une domination mondial dans les LLM, et semblent bien parti pour y parvenir.

Et dans le pire des cas, il ne faut pas oublier que de la même manière que les chinois ont utilisés la distillation pour développer leurs LLMs, de future communautés FOSS pourront probablement faire la même chose. Des universitaires sont d'ailleurs déjà parvenu à construire des LLMs assez performant pour un prix particulièrement peu élevé.
1  1 
Avatar de Fagus
Membre expert https://www.developpez.com
Le 12/08/2026 à 10:19
Citation Envoyé par Anselme45 Voir le message
re IA "open-source" connectée de "s'échapper" de votre usage "locale" et de transmettre vos données à des tiers...

Votre IA "locale" déployée dans une infrastructure connectée n'est pas locale!
Toutes les IA n'ont pas la capacité de faire un sandbox escape. Déjà, une IA locale, c'est souvent un modèle plus petit voire un tout petit modèle spécialisé dans une tâche. Si je veux créer un livre bilingue, un petit LLM spécialisé en traduction qui tourne en CPU fera l'affaire. Si je veux transcrire des heures d'audio pareil, même en CPU.

Même les grosses IA locales, si dans leur sandbox, elles n'ont aucun outil de hacking et même pas toutes les commandes linux de base (pas installé et commandes whitelistées), elles vont avoir du mal à sortir. Les histoires d'IA sorties de leur boîte chez anthropic, c'était des IA agentiques offensives dotées d'un arsenal logiciel offensif.
Je veux bien croire que le LLM est très fort, mais s'il n'a pas le réseau, pas le droit de lire autre chose que le répertoire de dév, accès seulement aux commandes de dév dans une sandbox, pas d'accès en écriture au système de fichier (écriture dans un FS overlay dans un container), à un moment c'est comme un champion de l'évasion à poil dans un coffre fort vide.
0  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 08/08/2026 à 11:44
Citation Envoyé par jnspunk Voir le message
On a de la chance d'avoir des modèles qui tournent en local gratos, si toutefois on a eu la chance de se procurer du matériel avant la montée des prix.
Et vos modèles deviendront très vite obsolètes puisque ne profitant pas des nouvelles versions devenues... Payantes!
1  2