Cybersécurité 18 min de lecture

DeepSeek pour les PME françaises : performances, données et souveraineté numérique

DeepSeek est performant et parle français, mais vos données partent en Chine. Analyse RGPD, décisions des régulateurs et alternative auto-hébergée pour PME.

·
DeepSeek pour les PME françaises : performances, données et souveraineté numérique — Blog ADN IA

L'essentiel

Au 16 septembre 2026, DeepSeek est une famille de modèles d'IA chinois performants, disponibles en français, avec un chat web officiel gratuit. Depuis avril 2026, la série V4 rivalise avec les meilleurs modèles du marché sur le code, et le 10 septembre 2026 l'éditeur a publié V4.1-Flash : un modèle plus petit que V4-Pro, donné devant lui sur la plupart des benchmarks agentiques de l'éditeur, au moins trois fois moins cher à l'API. V4-Flash est retiré ; V4-Pro, annoncé en retrait, reste servi pour l'instant selon la page tarifs. Mais le service en ligne stocke les données des utilisateurs en République populaire de Chine, sous juridiction chinoise, et V4.1-Flash n'y change rien. Deux régulateurs européens ont déjà agi — blocage du traitement en Italie, signalement de l'application à Apple et Google en Allemagne — et d'autres enquêtent. Pour une PME française, utiliser le cloud DeepSeek avec des données clients expose à un risque RGPD documenté. L'alternative existe : les poids de DeepSeek-R1, de la série V4 et de V4.1-Flash sont publiés sous licence MIT et peuvent être hébergés sur une infrastructure européenne, sans transfert de données vers la Chine.

---

DeepSeek, c'est quoi — et pourquoi tout le monde en parle

Vous avez entendu parler de DeepSeek sans vraiment savoir ce que c'est. Voici la réponse directe.

DeepSeek est une société de recherche en intelligence artificielle fondée à Hangzhou, en Chine. Elle développe des modèles de langage qui rivalisent avec les meilleurs modèles américains, pour un coût de développement annoncé comme bien inférieur. C'est ce rapport performance-coût qui a fait l'effet d'une bombe dans le secteur en janvier 2025.

La gamme active au 16 septembre 2026 comprend :

  • DeepSeek-R1 — sorti le 20 janvier 2025. Modèle de raisonnement, open-weights sous licence MIT complète. C'est toujours la porte d'entrée la plus simple pour un déploiement local en PME.
  • DeepSeek-V3 — modèle généraliste de décembre 2024. Les poids du checkpoint d'origine sont soumis à une licence modèle propre autorisant l'usage commercial ; les checkpoints ultérieurs de la série (V3-0324, V3.2) sont publiés sous licence MIT.
  • DeepSeek-V4-Pro et V4-Flash — dévoilés en préversion le 24 avril 2026. V4-Flash est passé en version stable le 31 juillet 2026 (build 0731), V4-Pro en disponibilité générale le 13 août 2026 (checkpoint 0813), avec trois niveaux d'effort de raisonnement et le support natif de la Responses API. V4-Pro aligne 1 600 milliards de paramètres dont 49 milliards actifs par token et un contexte d'un million de tokens ; V4-Flash, 284 milliards de paramètres dont 13 milliards actifs. Les poids des deux modèles sont publiés sur Hugging Face sous licence MIT. Depuis le 10 septembre 2026, V4-Flash est retiré de l'API (son identifiant est temporairement routé vers V4.1-Flash) et V4-Pro est annoncé en fin de vie, tout en restant servi à ce jour — voir la section datée plus bas.
  • DeepSeek-V4.1-Flash — publié le 10 septembre 2026, identifiant API « deepseek-flash ». Modèle MoE de 552 milliards de paramètres à architecture asymétrique : 8 milliards de paramètres actifs pour lire l'entrée, 16 milliards pour produire la sortie. Contexte d'un million de tokens, compréhension d'images native, effort de raisonnement réglable en continu. L'éditeur le donne devant V4-Pro sur la plupart de ses benchmarks agentiques. Poids publiés sur Hugging Face sous licence MIT.
  • DeepSeek-R2 — jamais sorti. La série V4, qui intègre un mode raisonnement, en tient lieu.

DeepSeek a créé la surprise parce qu'il propose des performances proches des meilleurs modèles propriétaires à un coût API bien inférieur. Pour une PME qui cherche à automatiser des tâches sans exploser son budget, la proposition est attrayante. Mais attrayante ne veut pas dire sans risque.

---

DeepSeek en français et gratuit : ce qui marche vraiment

Vous voulez utiliser DeepSeek en français, sans payer. Voici ce qui est réellement disponible.

Le chat web officiel sur chat.deepseek.com est gratuit. Il faut créer un compte : l'inscription est rapide, mais obligatoire. Vous ne pouvez pas utiliser le service officiel sans vous identifier.

Le support du français est natif. Vous écrivez en français, le modèle répond en français, sans configuration particulière. La qualité est solide pour l'écrit formel, la rédaction structurée et la traduction. Sur les tournures idiomatiques ou les textes à fort enjeu commercial, une relecture humaine reste recommandée.

Les sites « sans inscription » qui promettent DeepSeek sans compte ne sont pas des services officiels. Ce sont des agrégateurs tiers qui hébergent les modèles sur leur propre infrastructure, avec des versions variables et des conditions de traitement des données souvent encore moins transparentes. Y saisir des données professionnelles est une prise de risque supplémentaire.

L'API est payante, sans palier gratuit permanent. DeepSeek a introduit le 16 août 2026 une tarification en heures pleines et heures creuses, les heures creuses étant facturées moitié prix, puis a baissé ses prix le 10 septembre 2026 à 04 h 00 UTC avec l'arrivée de V4.1-Flash. Les heures pleines (01 h 00-04 h 00 et 06 h 00-10 h 00 UTC, du lundi au vendredi) couvrent notamment la matinée de travail française. Les tarifs en vigueur, lus sur la page tarifs de l'éditeur le 16 septembre 2026 :

ModèlePériodeEntrée (cache hit)Entrée (cache miss)Sortie
V4.1-Flash (« deepseek-flash »)Heures creuses0,003 $/M tokens0,15 $/M tokens0,60 $/M tokens
V4.1-Flash (« deepseek-flash »)Heures pleines0,006 $/M tokens0,30 $/M tokens1,20 $/M tokens
V4-Pro (« deepseek-v4-pro »)Heures creuses0,022 $/M tokens0,66 $/M tokens1,98 $/M tokens
V4-Pro (« deepseek-v4-pro »)Heures pleines0,044 $/M tokens1,32 $/M tokens3,96 $/M tokens

V4-Flash et V4-Flash-Vision-Exp ont été retirés de l'API le 10 septembre 2026 : leurs anciens identifiants sont temporairement routés vers V4.1-Flash et facturés au tarif Flash. Pour V4-Pro, l'annonce du 10 septembre prévoyait le même routage à partir du 14 septembre 2026 à 04 h 00 UTC, mais la page tarifs indique, au 16 septembre, que le modèle reste servi après cette date, facturation inchangée — détails dans la section datée ci-dessous.

Même en heures pleines, ces tarifs restent compétitifs face aux équivalents propriétaires. Mais ils ne changent pas la question centrale : où vont vos données ?

---

Ce qui a changé le 10 septembre 2026 : V4.1-Flash arrive, V4-Pro en sursis

Le 10 septembre 2026, DeepSeek a publié V4.1-Flash : 552 milliards de paramètres, contre 1 600 pour V4-Pro, et pourtant devant lui sur la plupart des benchmarks agentiques de l'éditeur (Terminal-Bench 2.1 : 90,6 contre 87,9), derrière lui sur le raisonnement scientifique (GPQA Diamond : 90,9 contre 92,4). Trois conséquences, lues chez l'éditeur le 16 septembre 2026.

  • Un identifiant API à retenir : « deepseek-flash ». V4-Flash et V4-Flash-Vision-Exp sont retirés ; leurs anciens noms sont temporairement routés vers V4.1-Flash, au tarif Flash : 0,15 $ par million de tokens en entrée et 0,60 $ en sortie en heures creuses, le double en heures pleines.
  • V4-Pro : annoncé en retrait, maintenu pour l'instant. L'annonce prévoyait, à partir du 14 septembre 2026 à 04 h 00 UTC, de servir toutes les requêtes « deepseek-v4-pro » par V4.1-Flash, à son tarif, jusqu'à un futur V4.1-Pro. Mais la page tarifs et le journal des modifications indiquent, au 16 septembre, que DeepSeek a « décidé de continuer à fournir le service API de DeepSeek V4 Pro après le 14 septembre 2026 », facturation inchangée, « en réponse à la demande des utilisateurs ». La page tarifs fait foi ; un préavis est promis en cas de changement.
  • Rien ne change sur le fond. Même API, même politique de confidentialité ; poids sous licence MIT sur Hugging Face, comme la série V4. Le modèle du chat gratuit (application et web) au 16 septembre 2026 : non nommé par l'éditeur. L'annonce ne parle que de l'API, et les notes de version de l'application sur l'App Store (2.5.0 du 11 septembre 2026) évoquent seulement une « mise à jour du modèle » qui unifie les modes Instant, Expert et Vision.

Le détail, prix et benchmarks compris, dans notre analyse de DeepSeek V4.1-Flash.

---

Où vont vos données ? La politique de confidentialité sans filtre

Vos équipes utilisent DeepSeek pour rédiger des emails, analyser des contrats, préparer des offres commerciales. Vous pensez que c'est anodin. Ce ne l'est pas.

La politique de confidentialité de DeepSeek, publiée en anglais sur cdn.deepseek.com, est explicite sur plusieurs points que beaucoup d'utilisateurs ne lisent jamais.

Ce que DeepSeek collecte :

  • Le contenu des échanges — historique de chat, prompts, fichiers téléversés, retours utilisateur.
  • Les données de profil — informations de compte, identifiants.
  • Les données techniques — adresse IP, modèle d'appareil, système d'exploitation, identifiants de l'appareil, cookies, localisation approximative.

Où ces données sont stockées :

La politique l'écrit noir sur blanc : « we directly collect, process and store your Personal Data in People's Republic of China » — les données personnelles sont collectées, traitées et stockées en République populaire de Chine.

Quel droit s'applique :

Le droit chinois, qui comprend notamment la loi sur la cybersécurité de 2017, la loi sur le renseignement national de 2017 et la loi sur la sécurité des données de 2021. Ces textes permettent aux autorités chinoises de demander l'accès aux données détenues par des entreprises opérant sous leur juridiction.

À qui les données peuvent être transmises :

Prestataires de services, entités du groupe, et autorités sur demande légale.

Pour une PME française qui traite des données clients, des informations contractuelles ou des données de salariés, chaque prompt envoyé au cloud DeepSeek est potentiellement soumis à ce cadre juridique. Ce n'est pas une hypothèse alarmiste : c'est ce que dit la politique de confidentialité elle-même.

---

Ce qu'ont dit les régulateurs européens (décisions datées)

Plusieurs autorités de protection des données ont réagi rapidement. Voici l'état des lieux en août 2026.

Mesures formelles effectives :

  • Garante (Italie) — Après une demande d'informations le 28 janvier 2025, la Garante a ordonné le 30 janvier 2025 la limitation définitive du traitement des données des utilisateurs italiens, sur la base de l'article 58(2)(f) du RGPD. La décision relève notamment l'absence de base légale démontrée, d'information en italien et de représentant dans l'Union. C'est la première mesure contraignante émise en Europe contre DeepSeek, et une instruction a été ouverte dans la foulée.
  • BlnBDI (Berlin, Allemagne) — Le 27 juin 2025, l'autorité berlinoise a signalé l'application DeepSeek à Apple et Google comme contenu illicite au titre de l'article 16 du Digital Services Act, en raison du transfert illicite des données d'utilisateurs allemands vers la Chine. DeepSeek n'avait pas donné suite à sa demande préalable de mise en conformité ou de retrait.

Enquêtes et mises en garde, sans décision finale publiée :

  • Fin janvier 2025, l'autorité néerlandaise (AP) a publiquement mis en garde contre la saisie de données personnelles dans DeepSeek, et la DPC irlandaise a demandé des explications à l'entreprise.
  • La CNIL a indiqué à la presse fin janvier 2025 qu'elle analyserait le fonctionnement de DeepSeek et interrogerait la société. À ce jour (août 2026), son site ne publie ni décision ni communiqué la concernant.
  • L'EDPB a élargi le 12 février 2025 le périmètre de sa task force ChatGPT à l'application de la réglementation sur l'IA en général et annoncé la création d'une équipe de réaction rapide pour coordonner les autorités nationales.

Le bilan est clair : l'Italie a imposé une limitation contraignante du traitement, Berlin a déclenché un signalement formel, et plusieurs autres autorités ont ouvert des enquêtes qui n'ont pas été closes. Aucun blanc-seing n'a été délivré. Pour une PME française qui traite des données personnelles, utiliser le service cloud DeepSeek sans analyse préalable est une prise de risque documentée.

---

L'alternative : DeepSeek en auto-hébergement open-weights

Vous voulez les performances de DeepSeek sans envoyer vos données en Chine. C'est possible, et c'est même la vraie particularité de cet éditeur.

DeepSeek-R1 est disponible sur Hugging Face (deepseek-ai/DeepSeek-R1) sous licence MIT complète : usage commercial, modifications et distillations autorisés. Vous téléchargez les poids, vous les hébergez sur votre infrastructure ou chez un hébergeur européen, et le modèle tourne sans aucun transfert de données vers l'extérieur. Pour les équipes sans GPU lourd, des variantes distillées (Llama-8B, Qwen-32B, Llama-70B) sont utilisables via Ollama, et des quantizations GGUF allègent encore le déploiement.

Les séries V4 et V4.1 sont elles aussi open-weights. Depuis 2026, les poids de V4-Pro et V4-Flash sont publiés sur Hugging Face sous licence MIT ; ceux de V4.1-Flash le sont depuis le 10 septembre 2026, sous la même licence. Il faut rester lucide sur les moyens nécessaires : V4-Pro et ses 1 600 milliards de paramètres sont hors de portée d'une infrastructure de PME ; V4-Flash (284 milliards de paramètres, 13 milliards actifs) et V4.1-Flash (552 milliards, 8 à 16 milliards actifs) n'activent qu'une fraction de leurs paramètres à chaque token, mais l'ensemble des poids doit rester chargé : cela reste une infrastructure GPU dédiée sérieuse, en interne ou chez un hébergeur européen. L'éditeur promet de travailler avec la communauté open source sur le support d'inférence de V4.1-Flash, sans calendrier.

La série V3 reste disponible également : ses checkpoints récents (V3-0324, V3.2) sont publiés sur Hugging Face sous licence MIT.

Selon notre expérience projet, une variante distillée de R1 servie par Ollama sur une infrastructure standard couvre la majorité des cas d'usage métier courants d'une PME — rédaction assistée, synthèse de documents internes, classification. Le tout sans qu'aucune donnée ne quitte votre périmètre.

---

DeepSeek vs ChatGPT : deux paragraphes, pas plus

Sur le raisonnement scientifique expert (GPQA Diamond), GPT-5.6 Sol, le modèle haut de gamme d'OpenAI, atteint 94,1 contre 90,1 pour la préversion de DeepSeek-V4-Pro (fiche Hugging Face d'avril 2026). L'écart existe, mais il s'est resserré. Sur le code, V4-Pro affiche 80,6 sur SWE-bench Verified et 93,5 sur LiveCodeBench — parmi les meilleurs scores publiés par un modèle open-weights. En pratique : avantage OpenAI sur le raisonnement expert et les workflows agentiques longs, quasi-parité sur la génération de code. La fiche de V4.1-Flash, publiée le 10 septembre 2026, donne 90,9 sur GPQA Diamond au nouveau modèle, contre 94,1 pour GPT-5.6 Sol et 92,4 pour la version d'août de V4-Pro, et le place devant V4-Pro sur la plupart des benchmarks agentiques (Terminal-Bench 2.1 : 90,6 contre 87,9 ; DeepSWE v1.1 : 74,2 contre 62,7).

Côté prix, le rapport de force est inversé. L'API V4-Pro coûte, au 16 septembre 2026, 0,66 $ par million de tokens en entrée et 1,98 $ en sortie en heures creuses (1,32 $/3,96 $ en heures pleines), et V4.1-Flash descend à 0,15 $/0,60 $ en heures creuses (0,30 $/1,20 $ en heures pleines), quand GPT-5.6 Sol est facturé 4 $/20 $ (depuis le 21 août 2026) et Terra 2 $/12 $ (septembre 2026). Pour des volumes importants, l'écart se chiffre vite. Le choix dépend donc du cas d'usage et de votre politique de données, pas d'une préférence abstraite. Pour élargir la perspective sur les modèles chinois et open-weights, consultez notre analyse de Kimi K3 ou la comparaison Claude Fable 5 vs Kimi K3.

---

Cas d'usage PME : ce qui est acceptable, ce qui est à proscrire

Vous cherchez une règle simple. La voici : la frontière passe entre les données génériques et les données identifiantes ou confidentielles.

Ce qui est acceptable avec le service cloud DeepSeek :

  • Rédaction de contenus génériques — articles de blog, descriptions produits, textes marketing sans données clients.
  • Traduction de documents publics — brochures, textes réglementaires, documentation technique non confidentielle.
  • Exploration de concepts — brainstorming, structuration d'idées, recherche documentaire sur des sujets publics.
  • Génération de code — scripts, fonctions, prototypes, à condition que le code ne contienne ni données sensibles ni secrets métier.

Ce qui est à proscrire avec le service cloud DeepSeek :

  • Données personnelles de clients ou de salariés — noms, emails, téléphones, données RH. Chaque envoi constitue un transfert de données personnelles vers la Chine, sans garantie adéquate au regard du RGPD.
  • Informations contractuelles confidentielles — clauses, tarifs, conditions négociées avec des partenaires ou clients.
  • Données financières — bilans, prévisions, données comptables identifiantes.
  • Propriété intellectuelle sensible — code source propriétaire, formulations brevetées, savoir-faire différenciant.
  • Données réglementées — données de santé, données bancaires, toute donnée soumise à un régime spécifique.

Pour ces usages, l'auto-hébergement d'un modèle DeepSeek open-weights ou le recours à un acteur européen comme Mistral — voir notre comparaison Mistral vs ChatGPT — sont les alternatives à étudier. Nos services cybersécurité couvrent l'audit de ces choix d'architecture IA.

---

Notre lecture

DeepSeek est un outil sérieux. Ses performances sont réelles, son support du français est fonctionnel, et sa politique d'ouverture des poids — de R1 à V4.1-Flash, sous licence MIT — en fait une opportunité concrète pour les PME qui veulent de l'IA sans dépendance à un cloud américain ou chinois.

Mais le service cloud DeepSeek, tel qu'il fonctionne aujourd'hui, n'est pas compatible avec une utilisation professionnelle impliquant des données personnelles ou confidentielles dans un contexte français. Ce n'est pas une opinion : c'est ce que disent la politique de confidentialité de l'éditeur, le RGPD et les régulateurs qui ont déjà agi.

La bonne question n'est donc pas « DeepSeek, oui ou non ? », mais « quel modèle, hébergé où, pour quel usage ? ». Un déploiement local d'un modèle open-weights sur une infrastructure européenne répond à cette question pour beaucoup de PME. Un audit de vos cas d'usage IA permet de cartographier ce qui est acceptable et ce qui ne l'est pas.

Si vous voulez en discuter, contactez-nous. Nous travaillons sur ce type de problématique au quotidien.

---

Sources

  • Politique de confidentialité DeepSeek — « we directly collect, process and store your Personal Data in People's Republic of China » : collecte, traitement et stockage des données personnelles en République populaire de Chine (vérifié le 16 septembre 2026)
  • Décision de la Garante italienne du 30 janvier 2025 — provvedimento n. 33 : limitation définitive du traitement des données des utilisateurs italiens au titre de l'article 58(2)(f) du RGPD, données conservées en République populaire de Chine (vérifié le 16 septembre 2026)
  • Communiqué de la BlnBDI du 27 juin 2025 — signalement de l'application DeepSeek à Apple et Google comme contenu illicite au titre de l'article 16 du Digital Services Act, pour transfert illicite des données d'utilisateurs allemands vers la Chine (vérifié le 16 septembre 2026)
  • Grille tarifaire et fiche des modèles de l'API DeepSeek — V4.1-Flash (« deepseek-flash ») à 0,003/0,15/0,60 $ par million de tokens en heures creuses (cache hit, cache miss, sortie) et 0,006/0,30/1,20 $ en heures pleines ; V4-Pro à 0,022/0,66/1,98 $ et 0,044/1,32/3,96 $ ; contexte d'un million de tokens ; heures pleines 01 h 00-04 h 00 et 06 h 00-10 h 00 UTC du lundi au vendredi ; note 2 : service API de V4-Pro maintenu après le 14 septembre 2026, facturation inchangée (vérifié le 16 septembre 2026)
  • Annonce officielle DeepSeek-V4-Pro GA et nouvelle grille tarifaire (13 août 2026) — V4-Pro sur l'application et le web via le mode Expert et sur l'API, trois niveaux d'effort de raisonnement, tarification heures pleines/heures creuses effective le 16 août 2026 à 16 h 00 UTC (vérifié le 16 septembre 2026)
  • Model card DeepSeek-V4-Pro (licence, benchmarks) — fiche de la préversion d'avril 2026 : 1 600 milliards de paramètres dont 49 milliards actifs, contexte d'un million de tokens, poids sous licence MIT, GPQA Diamond 90,1, SWE-bench Verified 80,6, LiveCodeBench 93,5 (vérifié le 16 septembre 2026)
  • Note de version DeepSeek-V4.1-Flash (10 septembre 2026) — identifiant « deepseek-flash », retrait de V4-Flash et V4-Flash-Vision-Exp, routage annoncé de « deepseek-v4-pro » vers V4.1-Flash à partir du 14 septembre 2026 à 04 h 00 UTC « jusqu'au lancement de V4.1-Pro », nouveaux prix au 10 septembre 2026 à 04 h 00 UTC (vérifié le 16 septembre 2026)
  • Annonce « Introducing DeepSeek-V4.1-Flash » sur le site de l'éditeur — 552 milliards de paramètres, 8 milliards actifs en entrée et 16 en sortie, compréhension visuelle native, « We're phasing out V4-Pro », support open source annoncé (vérifié le 16 septembre 2026)
  • Journal des modifications de l'API DeepSeek — entrée du 10 septembre 2026 : sortie de V4.1-Flash, retrait des V4-Flash, maintien du service API de V4 Pro après le 14 septembre 2026 « en réponse à la demande des utilisateurs », baisse des prix (vérifié le 16 septembre 2026)
  • Model card DeepSeek-V4.1-Flash sur Hugging Face — dépôt et poids sous licence MIT, 552 milliards de paramètres, contexte d'un million de tokens, multimodal, benchmarks face à V4-Pro et GPT-5.6 Sol (vérifié le 16 septembre 2026)
  • Model card DeepSeek-V4-Pro-0813 sur Hugging Face — version officielle du 13 août 2026 remplaçant la préversion, poids sous licence MIT, Terminal-Bench 2.1 à 87,9 et DeepSWE à 62,7 (vérifié le 16 septembre 2026)
  • Notes de version de l'application DeepSeek sur l'App Store — version 2.5.0 du 11 septembre 2026 : « New model update: Instant, Expert, and Vision modes are now unified », sans nom de modèle (vérifié le 16 septembre 2026)

Sources

deepseekrgpdsouverainete-numeriquecybersecuritepmeia-generative

Besoin d'aide pour votre projet ?

Premier audit gratuit — on analyse votre situation en 30 minutes.

Articles similaires