DeepSeek : l’IA chinoise qui bouscule la Silicon Valley
En janvier 2025, un modèle d’IA venu de Chine a fait perdre environ 589 milliards de dollars de capitalisation à Nvidia en une seule journée. Ce modèle s’appelle DeepSeek. Depuis, la startup a sorti V4, levé plus de 7 milliards de dollars et continue de tirer les prix vers le bas. Voici ce qu’il faut savoir.
Le 27 janvier 2025, les marchés financiers ont connu une journée historique. Nvidia, alors première capitalisation boursière mondiale, a perdu près de 17 % en une séance, soit environ 589 milliards de dollars de valeur boursière selon Bloomberg. Aucune entreprise cotée à Wall Street n’avait jamais perdu autant en un jour. Cette chute avait pour origine DeepSeek-R1, un modèle d’IA open source développé par une startup chinoise alors presque inconnue en Occident.
Deepseek R1 is AI’s Sputnik moment.
Depuis ce choc, DeepSeek a continué d’avancer. Ses modèles sont intégrés dans de nombreuses plateformes, et V4, attendu pendant des mois, est sorti en préversion le 24 avril 2026. La version V4.1-Flash a suivi le 10 septembre 2026. Pour replacer DeepSeek parmi Alibaba, Moonshot ou Zhipu, vous pouvez lire notre panorama des géants de l’IA en Chine.
DeepSeek, c’est qui ?
DeepSeek est un laboratoire de recherche en intelligence artificielle fondé en juillet 2023 à Hangzhou par Liang Wenfeng. Ce gestionnaire dirige aussi High-Flyer, un fonds d’investissement quantitatif qui a financé les débuts du laboratoire. Le projet part d’une conviction simple : on peut construire des modèles de niveau mondial sans dépenser des dizaines de milliards de dollars. Avec une équipe réduite, DeepSeek s’est imposé comme l’un des concurrents les plus sérieux d’OpenAI, de Google et d’Anthropic.
Son approche se distingue par la recherche d’économies. DeepSeek a entraîné ses premiers grands modèles sur des puces Nvidia H800, une version bridée conforme aux restrictions américaines de l’époque. L’entreprise a chiffré le dernier cycle d’entraînement de V3 à environ 6 millions de dollars, et un article publié dans Nature en septembre 2025 a évalué à 294 000 dollars l’étape supplémentaire qui a produit R1. Ces montants n’incluent ni la recherche préalable ni l’achat du matériel.
Pendant plus de deux ans, DeepSeek a refusé les investisseurs extérieurs. En juin 2026, le laboratoire a finalement levé plus de 7 milliards de dollars pour une valorisation supérieure à 50 milliards, selon The Information. Tencent, CATL, JD.com et un fonds public chinois consacré à l’IA ont participé, et Liang Wenfeng a lui-même apporté près de 3 milliards. D’après Bloomberg et le Financial Times, DeepSeek prépare aussi une introduction en bourse.
Côté licence, DeepSeek publie les poids de ses modèles sous licence MIT. N’importe qui peut les télécharger, les modifier et les utiliser, y compris dans un produit commercial.
Les modèles DeepSeek disponibles aujourd’hui
La gamme a beaucoup changé depuis janvier 2025. Les anciens noms d’API deepseek-chat et deepseek-reasoner, qui pointaient vers V3.2, ont été retirés le 24 juillet 2026. Le tableau ci-dessous résume les modèles actuels.
| Modèle | Sortie | Taille | Usage principal |
|---|---|---|---|
| DeepSeek-V4.1-Flash | 10 septembre 2026 | 552 milliards de paramètres, 8 à 16 milliards actifs | Modèle rapide et multimodal, désormais le plus performant de la gamme selon DeepSeek |
| DeepSeek-V4-Pro | Préversion le 24 avril 2026, version définitive le 13 août 2026 | 1 600 milliards de paramètres, 49 milliards actifs | Agents, code et raisonnement complexe |
| DeepSeek-V4-Flash | Préversion le 24 avril 2026, version définitive le 31 juillet 2026 | 284 milliards de paramètres, 13 milliards actifs | Usage courant à bas coût, remplacé par V4.1-Flash dans l’API |
| DeepSeek-R1 | Janvier 2025 | 671 milliards de paramètres, 37 milliards actifs | Raisonnement, modèle historique téléchargeable |
| DeepSeek-OCR | Octobre 2025 | Environ 3 milliards de paramètres | Lecture de documents et d’images |
DeepSeek V4 : une sortie longtemps attendue
La presse a annoncé V4 pendant plusieurs mois, d’abord pour février puis pour mars 2026. DeepSeek a finalement publié une préversion le 24 avril 2026, en deux tailles : V4-Pro et V4-Flash. Les deux modèles gèrent un contexte d’un million de tokens, devenu la norme sur tous les services officiels de DeepSeek. Ils proposent un mode avec raisonnement et un mode sans raisonnement, et leurs poids sont disponibles sur Hugging Face. L’architecture combine une compression des tokens avec l’attention clairsemée DeepSeek Sparse Attention, ce qui réduit fortement le calcul nécessaire sur les longs contextes.
Selon Reuters, Huawei a indiqué que ses puces Ascend avaient servi à une partie de l’entraînement de V4, aux côtés de puces Nvidia. Le fabricant chinois a annoncé un support complet des modèles DeepSeek sur sa gamme Ascend. Le jour du lancement, les actions des fondeurs chinois SMIC et Hua Hong ont bondi, alors que celles de Zhipu et MiniMax, deux concurrents cotés à Hong Kong, ont reculé d’environ 9 %. Nvidia n’a pas connu de chute comparable à celle de janvier 2025.
Dans son rapport technique, DeepSeek reconnaissait que V4-Pro restait légèrement en retrait de GPT-5.4 et de Gemini 3.1 Pro, avec un décalage estimé à quelques mois. Le modèle se plaçait en revanche en tête des modèles ouverts sur le code agentique et le raisonnement. Son prix a surtout marqué les esprits : Fortune notait que la sortie de V4-Pro coûtait 3,48 dollars le million de tokens au lancement, contre 25 à 30 dollars chez Anthropic et OpenAI. La veille, la Maison-Blanche avait accusé la Chine de copier la technologie américaine « à une échelle industrielle », ce que Pékin a démenti.
Les versions définitives de l’été 2026
DeepSeek a publié la version définitive de V4-Flash le 31 juillet 2026, puis celle de V4-Pro le 13 août. Ces mises à jour ont surtout amélioré les capacités d’agent. L’API accepte désormais le format Responses d’OpenAI, ce qui facilite l’usage avec Codex, et propose trois niveaux d’effort de raisonnement (bas, élevé, maximal). Depuis le 16 août 2026, les tarifs varient aussi selon l’heure : hors des heures de pointe, les prix baissent de moitié. Le 21 août, DeepSeek a ajouté un modèle expérimental de compréhension d’images.
DeepSeek V4.1-Flash : le petit modèle qui dépasse le grand
Le 10 septembre 2026, DeepSeek a lancé V4.1-Flash, un modèle de 552 milliards de paramètres qui comprend nativement les images. Son architecture n’active que 8 milliards de paramètres pour lire la demande et 16 milliards pour écrire la réponse. D’après DeepSeek, il dépasse V4-Pro en performance, en coût et en vitesse, et atteint 90,6 sur Terminal-Bench 2.1, un score que l’entreprise présente comme supérieur à ceux de Claude Opus 5 et de GPT-5.6 Sol. Ces chiffres viennent de DeepSeek et restent à confirmer par des tests indépendants. Les poids sont publiés sous licence MIT, et le modèle alimente désormais l’application et le site web. Un V4.1-Pro est attendu, sans date officielle.
Pourquoi DeepSeek fait trembler l’industrie
La question des investissements massifs
Le choc provoqué par DeepSeek en 2025 a d’abord été économique. Si une petite équipe pouvait produire des modèles proches de ceux d’OpenAI avec un budget bien plus faible, les centaines de milliards de dollars investis dans les centres de données américains devenaient plus difficiles à justifier. Les investisseurs se sont donc interrogés sur la demande future en puces haut de gamme. Nvidia a pourtant retrouvé des sommets dans les mois suivants, comme l’explique notre portrait de Nvidia.
L’effet sur la concurrence
Après le choc DeepSeek, les concurrents ont revu leurs tarifs et lancé des modèles plus économes, comme o3-mini chez OpenAI. D’autres laboratoires chinois ont suivi la même voie : Alibaba avec Qwen, Moonshot avec Kimi et Zhipu avec GLM publient à leur tour des modèles ouverts et bon marché. Cette pression sur les coûts profite directement aux utilisateurs.
Open source contre modèles fermés
DeepSeek incarne le camp des modèles ouverts face aux modèles propriétaires d’OpenAI, de Google ou d’Anthropic. En publiant ses poids, la startup permet à chacun de télécharger, modifier et déployer ses modèles. Cette ouverture explique leur intégration rapide dans des dizaines de services tiers, et elle a poussé la Chine à faire de l’open source un axe de sa stratégie d’IA.
Un symbole de l’autonomie technologique chinoise
Avec V4, DeepSeek est aussi devenu la vitrine des puces chinoises. Selon TrendForce, le laboratoire prévoit d’installer au moins 160 000 puces Huawei Ascend 950DT dans un centre de données en Mongolie-Intérieure. Cette alliance réduit sa dépendance à Nvidia, dont les ventes en Chine dépendent à la fois des licences américaines et du feu vert de Pékin.
Ce que DeepSeek change pour vous concrètement
Si vous utilisez déjà des outils IA
Vous utilisez peut-être déjà DeepSeek sans le savoir. Ses modèles sont proposés dans des agrégateurs comme Mammouth AI, dans des outils d’automatisation comme n8n et chez de nombreux hébergeurs. Quand vous sélectionnez un modèle DeepSeek dans l’un de ces services, c’est souvent une version hébergée hors de Chine qui répond. Notre fiche DeepSeek présente le chatbot et ses fonctions.
Si vous êtes développeur ou entrepreneur
L’API DeepSeek reste l’une des moins chères du marché. Aux heures de pointe, V4.1-Flash coûte 0,30 dollar le million de tokens en entrée et 1,20 dollar en sortie, et V4-Pro 1,32 dollar et 3,96 dollars. Ces prix baissent de moitié en dehors des heures de pointe, et les requêtes déjà en cache coûtent encore beaucoup moins. L’API est compatible avec les formats d’OpenAI et d’Anthropic, ce qui simplifie la migration. Notre guide de l’API DeepSeek pour les développeurs détaille l’intégration pas à pas.
Si vous êtes curieux ou créateur de contenu
DeepSeek est accessible gratuitement sur le web (chat.deepseek.com) et dans son application mobile. Vous pouvez y tester le raisonnement, la rédaction et le code sans abonnement, et un « mode expert » donne accès au modèle le plus avancé. La qualité en français est correcte, même si elle reste en retrait de Claude ou de ChatGPT sur les nuances de style. Pour aller plus loin, notre série Maîtriser DeepSeek de A à Z rassemble des tutoriels pratiques.
Les limites de DeepSeek à connaître
La question chinoise
DeepSeek est une entreprise chinoise, soumise aux règles de contenu de son pays. Sur certains sujets politiquement sensibles (Taïwan, Tiananmen, le Tibet), ses réponses sont évasives ou refusées. Pour un usage technique comme le code ou l’OCR, cette censure a peu d’effet. Pour la rédaction éditoriale ou les sujets géopolitiques, elle constitue une limite réelle. Plusieurs États ont aussi restreint son usage : l’Italie a bloqué l’application en 2025, l’Australie l’a bannie des appareils gouvernementaux, et la loi de défense américaine pour 2026 impose de la retirer des systèmes militaires et de renseignement. Notre article sur la conformité, la censure et les données détaille ces enjeux.
La transparence relative
Les poids des modèles sont publics, mais les données d’entraînement restent opaques. Plusieurs analystes jugent que les coûts réels de DeepSeek dépassent largement les montants annoncés, qui excluent la recherche et le matériel. Le 24 février 2026, Anthropic a aussi accusé DeepSeek, Moonshot AI et MiniMax d’avoir utilisé plus de 24 000 comptes frauduleux pour échanger plus de 16 millions de messages avec Claude et en extraire ses capacités. Les informations publiées par DeepSeek, y compris ses résultats de tests, méritent donc la même prudence que celles de n’importe quel autre acteur.
La confidentialité des données
Quand vous utilisez l’application ou l’API officielles, vos données sont traitées sur des serveurs en Chine. Pour des informations sensibles ou des données personnelles de clients, il vaut mieux passer par un hébergeur européen ou faire tourner le modèle sur vos propres serveurs.
Le matériel pour un usage local
Si vous souhaitez faire tourner DeepSeek sur votre machine, par exemple avec Ollama, sachez que les modèles complets exigent plusieurs cartes graphiques haut de gamme. Même V4.1-Flash, avec ses 552 milliards de paramètres, dépasse largement un ordinateur personnel. Les versions « distillées », plus petites, fonctionnent sur du matériel grand public, mais avec des performances réduites.
DeepSeek face à ChatGPT, Claude et Gemini
Face à GPT-5.6 Sol, OpenAI garde l’avantage sur l’écosystème, la qualité de rédaction et les outils intégrés à ChatGPT. DeepSeek affirme faire jeu égal sur plusieurs tests de code et d’agents, pour un prix bien inférieur.
Face à Claude Opus 5, sorti le 24 juillet 2026, le modèle d’Anthropic reste une référence pour l’analyse de longs documents, la nuance rédactionnelle et les garanties de sécurité demandées par les secteurs réglementés. DeepSeek l’emporte nettement sur le coût et sur la possibilité d’héberger le modèle soi-même.
Face à Gemini 3.1 Pro, le rapport technique de DeepSeek plaçait V4-Pro légèrement derrière le modèle de Google au moment de sa sortie. Gemini conserve l’avantage de son intégration dans les services Google, alors que DeepSeek mise sur l’ouverture et les prix bas.
En résumé, DeepSeek ne surpasse pas ses concurrents partout. Il s’en approche souvent, pour un coût bien plus faible, ce qui en fait un acteur central du marché.
Ce qu’il faut retenir sur DeepSeek
DeepSeek a démontré qu’on pouvait construire des modèles d’IA de niveau mondial sans les budgets de la Silicon Valley. En un peu plus de trois ans, le laboratoire est passé de l’anonymat à une valorisation de plus de 50 milliards de dollars. Ses modèles V4 et V4.1-Flash, entraînés en partie sur des puces chinoises, ont confirmé sa place parmi les meilleurs modèles ouverts.
Pour les utilisateurs, l’effet le plus concret reste la baisse des prix. La concurrence de DeepSeek pousse tous les acteurs à réduire leurs tarifs et à améliorer leur efficacité. Que vous utilisiez ChatGPT, Claude ou Gemini, vous profitez donc indirectement de cette pression.
Chaque utilisateur doit maintenant juger si les forces de DeepSeek (coût, ouverture, performance) compensent ses limites (censure, opacité, localisation des données) pour son usage précis. Cet arbitrage se fait en connaissance de cause, et il peut varier d’un projet à l’autre.
Portraits, concepts, tendances et guides pratiques : le blog rassemble tout ce qu’il faut connaître sur l’IA.