DeepSeek : l’IA open source chinoise qui défie OpenAI
📌 L’essentiel à retenir
DeepSeek est une IA chinoise dont les modèles sont publiés sous licence MIT et téléchargeables par tous. La société s’est fait connaître le 20 janvier 2025 avec R1, un modèle de raisonnement entraîné pour environ 5,6 millions de dollars, qui a fait chuter l’action Nvidia de près de 17 % en une séance. La gamme actuelle s’appelle V4 : une version rapide, une version experte, un million de tokens de contexte. Le site et l’application mobile restent gratuits. Deux réserves : les serveurs sont en Chine et certains sujets politiques sont censurés.
DeepSeek a fait irruption dans le monde de l’intelligence artificielle en janvier 2025, et ne l’a plus quittée depuis. Cette société chinoise publie des modèles de langage dont les poids sont libres, capables de rivaliser avec ChatGPT pour une fraction du coût d’entraînement. Elle a enchaîné les versions jusqu’à la génération V4, sortie en 2026. Ce guide vous explique ce qu’est DeepSeek, quels modèles existent, comment y accéder et ce qu’il faut savoir avant de lui confier vos données.
Pourquoi DeepSeek a secoué l’industrie de l’IA
La société Hangzhou DeepSeek Artificial Intelligence a été fondée en 2023 par Liang Wenfeng, dirigeant du fonds quantitatif chinois High-Flyer. Jusqu’au 20 janvier 2025, elle restait un acteur discret. Ce jour-là, elle publie DeepSeek-R1, un modèle de raisonnement comparable à OpenAI o1 sur plusieurs benchmarks. La société annonce l’avoir entraîné pour environ 5,6 millions de dollars, soit dix à cent fois moins que les modèles américains équivalents.
Une semaine plus tard, la bourse américaine réagit brutalement. Nvidia perd près de 17 % en une séance le 27 janvier 2025, soit environ 590 milliards de dollars de capitalisation : le plus gros décrochage d’une seule entreprise dans l’histoire de Wall Street. Les investisseurs réalisent qu’il est peut-être possible d’entraîner des IA de pointe sans commander des dizaines de milliers de GPU haut de gamme.
L’épisode n’a pas été un feu de paille. En 2026, DeepSeek figure parmi les outils d’intelligence artificielle les plus utilisés au monde. La société a levé 7 milliards de dollars au printemps 2026, pour une valorisation de 52 milliards, et prépare une possible introduction en bourse.
Les modèles DeepSeek, de R1 à V4
DeepSeek ne publie pas un modèle unique mais une famille, renouvelée deux à trois fois par an. Voici les jalons à connaître.
- V3 (décembre 2024) : le modèle de conversation généraliste qui sert de socle à toute la suite.
- R1 (20 janvier 2025) : le modèle de raisonnement qui a rendu DeepSeek célèbre, mis à jour en mai 2025.
- V3.1 (août 2025) puis V3.2 (fin 2025) : fusion du mode conversation et du mode raisonnement dans un seul modèle.
- V4-Flash et V4-Pro (2026) : la génération actuelle, avec une fenêtre de contexte d’un million de tokens.
DeepSeek-V3, le socle généraliste
Mis en ligne en décembre 2024, DeepSeek-V3 est un large modèle de langage de 671 milliards de paramètres, dont 37 milliards seulement sont activés à chaque requête grâce à une architecture Mixture of Experts. Il gère la conversation, la rédaction, le code et 128 000 tokens de contexte. Ses déclinaisons V3.1 et V3.2 ont ensuite intégré le raisonnement directement dans le modèle.
DeepSeek-R1, le modèle de raisonnement
DeepSeek-R1 est bâti sur V3 mais entraîné pour réfléchir avant de répondre. Il expose son raisonnement pas à pas, corrige ses erreurs de calcul et s’en sort mieux sur les mathématiques, le code et la logique. Publié sous licence MIT, ses poids restent téléchargeables sur Hugging Face, dans des versions allégées qui tiennent sur un ordinateur personnel. C’est le modèle DeepSeek que vous croiserez le plus souvent hors du site officiel.
DeepSeek-V4, la génération actuelle
Présentée en avril 2026 puis finalisée durant l’été, la génération V4 se décline en deux versions : V4-Flash, rapide et économique, et V4-Pro, le modèle haut de gamme de 1 600 milliards de paramètres. Les deux acceptent un million de tokens de contexte, de quoi avaler plusieurs livres dans une seule conversation. Leurs poids sont eux aussi publiés sous licence MIT, même si le fichier de V4-Pro dépasse 800 Go et reste hors de portée d’une machine domestique.
Un mot sur le fameux R2, souvent annoncé et jamais sorti : DeepSeek a renoncé à un successeur séparé de R1 et a préféré intégrer le raisonnement dans ses modèles principaux. Si vous cherchez R2, vous cherchez un modèle qui n’existe pas.
Un entraînement à faible coût : comment est-ce possible ?
Le chiffre des 5,6 millions de dollars ne couvre que la phase finale d’entraînement de V3, pas la recherche ni l’infrastructure. Il reste spectaculairement bas, et plusieurs choix techniques l’expliquent.
- Mixture of Experts (MoE) : seule une fraction des paramètres est mobilisée à chaque requête. L’inférence consomme donc bien moins qu’un modèle dense équivalent.
- Entraînement en précision FP8 : DeepSeek utilise des nombres à 8 bits là où la plupart des concurrents restent en 16 bits, ce qui double la vitesse et divise la mémoire par deux.
- Distillation : les plus petites déclinaisons de R1 (de 1,5 à 70 milliards de paramètres) sont entraînées à imiter le grand modèle, pour tourner sur un PC ou un serveur modeste.
- Apprentissage par renforcement pur : la version R1-Zero apprend à raisonner sans supervision humaine étape par étape, uniquement à partir du résultat final.
Ces optimisations ne sont pas des secrets : DeepSeek a publié les articles scientifiques détaillant la méthode. N’importe quel laboratoire peut les reproduire, ce qui inquiète les acteurs américains habitués à un avantage lié à leurs moyens financiers.
DeepSeek face à ChatGPT, Claude et Gemini
La différence tient moins aux performances brutes, qui se rejoignent d’une version à l’autre, qu’au modèle économique. DeepSeek ouvre les poids de ses modèles, ses concurrents américains les gardent fermés.
| Service | Éditeur | Licence des modèles | Poids téléchargeables | Usage grand public gratuit |
|---|---|---|---|---|
| DeepSeek | DeepSeek (Chine) | MIT | Oui | Oui, sans quota annoncé |
| ChatGPT | OpenAI (États-Unis) | Propriétaire | Non | Oui, avec quotas |
| Claude | Anthropic (États-Unis) | Propriétaire | Non | Oui, avec quotas |
| Gemini | Google (États-Unis) | Propriétaire | Non | Oui, avec quotas |
| Le Chat | Mistral AI (France) | Mixte | En partie | Oui, avec quotas |
Côté tarifs, DeepSeek casse les prix. Son API facture V4-Flash entre 0,22 et 0,44 dollar par million de tokens en entrée selon l’heure de la journée, et V4-Pro entre 0,66 et 1,32 dollar, soit environ 0,20 à 1,20 euro. Les modèles propriétaires haut de gamme se facturent plusieurs dollars sur la même base. Pour situer les tarifs du concurrent américain, voyez notre comparatif des prix de ChatGPT. Côté français, l’article sur Le Chat de Mistral AI présente l’alternative européenne.
Comment utiliser DeepSeek
Depuis le site officiel ou l’application mobile
Rendez-vous sur chat.deepseek.com ou téléchargez l’application iOS ou Android. Vous créez un compte avec une adresse e-mail ou un compte Google, puis vous tapez votre question. L’interface reprend les codes de n’importe quel chatbot : le bouton DeepThink bascule le modèle en mode raisonnement, Search autorise la recherche web, et un trombone permet d’envoyer un fichier. Les menus sont en anglais, mais DeepSeek comprend parfaitement le français.
Via l’API, pour les développeurs
L’API DeepSeek est compatible avec le format OpenAI. Si vous avez déjà du code qui appelle GPT, il suffit de changer l’URL de base, la clé et le nom du modèle (deepseek-v4-flash ou deepseek-v4-pro). La documentation se trouve sur api-docs.deepseek.com. Pour rédiger de bonnes instructions adaptées à un modèle de raisonnement, consultez notre guide du prompt.
En local, avec Ollama
Les versions distillées de R1 (1,5 B, 7 B, 8 B, 14 B, 32 B, 70 B paramètres) sont open source et tournent sur votre propre machine. Avec Ollama :
ollama run deepseek-r1:7b
Comptez 5 à 8 Go de RAM pour la 7 B, plus d’une vingtaine pour la 32 B. Aucune donnée ne quitte votre ordinateur, ce qui règle les questions de confidentialité abordées ci-dessous. Les modèles V4, eux, réclament une infrastructure de serveur : ils ne s’installent pas sur un PC de bureau. Pour les gros modèles distillés, les Mac à mémoire unifiée sont devenus très recherchés, au point que le Mac Studio M5 Ultra affiche plusieurs mois de délai.
Confidentialité et censure : les points de vigilance
DeepSeek reste soumise au droit chinois. Quatre limites méritent d’être connues avant de l’adopter au quotidien.
- Hébergement en Chine : sur la version web et l’application, vos conversations transitent par des serveurs situés en République populaire de Chine. L’Italie a bloqué l’application dès fin janvier 2025, après une mise en demeure de son autorité de protection des données. Évitez d’y saisir des informations sensibles ou des documents professionnels confidentiels.
- Réutilisation des conversations : vos échanges peuvent servir à améliorer les modèles. Sur le service officiel, aucun réglage ne permet de s’y opposer aussi simplement que chez les éditeurs européens.
- Censure politique : le modèle refuse de répondre aux questions sur Tiananmen, Taïwan, le Xinjiang ou la critique du Parti communiste chinois. Les versions téléchargeables localement gardent une partie de ce biais, même si des communautés le contournent par fine-tuning.
- Erreurs factuelles : comme tous les grands modèles, DeepSeek peut inventer des faits avec aplomb. Vérifiez ce qu’il vous affirme avant de le reprendre dans un document sérieux.
Pour un usage professionnel ou sensible, la version locale via Ollama ou une solution d’IA hébergée en Europe reste préférable.
Faut-il adopter DeepSeek ?
Pour un usage personnel sans enjeu, DeepSeek est une excellente affaire : gratuit, rapide, très bon en code et en mathématiques, sans quota agressif. Pour un travail confidentiel, un devis client ou des données de santé, passez votre chemin ou installez une version locale. Le meilleur compromis, si vous êtes à l’aise avec un peu de technique, consiste à garder le site officiel pour les questions anodines et un modèle distillé sur votre machine pour tout le reste.
Foire aux questions
Oui, le site chat.deepseek.com et les applications mobiles sont gratuits, sans quota strict annoncé, y compris pour les modèles les plus récents. Seule l’API, destinée aux développeurs, est facturée au million de tokens.
La génération V4, présentée en avril 2026 et finalisée durant l’été. Elle se décline en V4-Flash, rapide et économique, et V4-Pro, le modèle haut de gamme de 1 600 milliards de paramètres, avec un million de tokens de contexte.
Non. Le successeur direct de R1 n’a jamais été publié. DeepSeek a préféré intégrer le raisonnement dans ses modèles principaux, d’abord V3.1 et V3.2, puis V4 et son bouton DeepThink.
Sur le raisonnement, les mathématiques et le code, DeepSeek se situe au niveau des meilleurs modèles propriétaires. Sur la conversation généraliste et la finesse du français, ChatGPT garde souvent une longueur d’avance.
Oui, si vous passez par le site ou l’application officielle : les serveurs sont en République populaire de Chine. Pour garder vos données en local, installez une version distillée de DeepSeek-R1 avec Ollama sur votre ordinateur.
Les poids des modèles, V4-Pro compris, sont publiés sous licence MIT sur Hugging Face et réutilisables même à titre commercial. Les données d’entraînement, elles, ne sont pas diffusées : on parle donc plus justement de modèle à poids ouverts.
Oui, via les versions distillées de R1 et un outil comme Ollama ou LM Studio. Une machine avec 8 Go de RAM fait tourner la 7 B, un PC avec 32 Go et un GPU récent encaisse la 32 B. Les modèles V4 exigent une infrastructure de serveur.
Le modèle est soumis à la législation chinoise, qui interdit les contenus politiquement sensibles. Il esquive donc les questions sur Tiananmen, Taïwan, le Xinjiang ou le Parti communiste chinois, y compris dans les versions locales.

Commentaires
Laisser un commentaire