IA

Claude Fable 5 vs Kimi K3 : la conformité ou le prix ?

D'un côté, le modèle frontier d'Anthropic : fermé, encadré, disponible en régions européennes via AWS Bedrock et Google Vertex AI. De l'autre, le géant open-weights de Moonshot AI : 2 800 milliards de paramètres, poids téléchargeables sur Hugging Face, tarif API 3,3 fois inférieur. Les deux partagent une fenêtre de contexte d'un million de tokens et des performances de premier rang. Pour une PME française, l'arbitrage tient en une question : que valent vos données ?

Parler de votre projet
Verdict express

Claude Fable 5, lancé le 9 juin 2026 par Anthropic, est le premier modèle de classe Mythos rendu généralement accessible : $10 par million de tokens en entrée, $50 en sortie (août 2026), fenêtre d'un million de tokens, disponible sur AWS Bedrock et Google Vertex AI avec des endpoints régionaux européens. Kimi K3, mis en service par Moonshot AI en juillet 2026, est un MoE de 2 800 milliards de paramètres (104 milliards actifs) aux poids publiés sur Hugging Face : $3 en entrée, $0,30 en cache-hit, $15 en sortie (août 2026). Sur le tableau de benchmarks publié par Moonshot AI, les deux se rendent coup pour coup : Kimi K3 devance sur BrowseComp (91,2 contre 88,0) et MCPMark-Verified (94,5 contre 87,4), Fable 5 l'emporte sur FrontierSWE (86,6 contre 81,2) et OSWorld 2.0 (66,1 contre 58,3). Pour des données personnelles, Fable 5 via les régions UE de Bedrock ou Vertex AI est le choix le plus simple à défendre ; l'API Kimi K3 est hébergée à Singapour et les textes officiels de Moonshot AI se contredisent sur l'usage des contenus pour améliorer les modèles. L'auto-hébergement de Kimi K3 existe sur le papier, mais exige environ 1,5 To de poids et un nœud multi-GPU de datacenter. Verdict court : données sensibles ou clientes, Fable 5 ; gros volumes sur données non personnelles, Kimi K3.

Les acteurs en présence

Qui est qui en 2026 ?

Claude Fable 5

Le modèle frontier d'Anthropic, encadré pour un usage général

Claude Fable 5 est lancé le 9 juin 2026 par Anthropic : c'est le premier modèle de classe Mythos rendu généralement accessible, coiffé de classifieurs de sécurité qui renvoient les requêtes sensibles (cybersécurité, biologie et chimie, distillation de modèles) vers Claude Opus 4.8. Il est facturé $10 par million de tokens en entrée et $50 en sortie (août 2026), moitié prix en batch. Le modèle est disponible depuis le premier jour sur l'API Claude, AWS Bedrock, Google Vertex AI et Microsoft Foundry — avec des endpoints régionaux européens chez AWS et Google.

Kimi K3

Le géant open-weights de Moonshot AI, frontier et déployable

Kimi K3 est mis en service sur l'API de Moonshot AI le 16 juillet 2026, puis ses poids sont publiés sur Hugging Face (moonshotai/Kimi-K3) fin juillet 2026 sous licence Kimi K3. C'est un modèle MoE de 2 800 milliards de paramètres, dont 104 milliards actifs par token, avec une fenêtre d'un million de tokens et des entrées texte, image et vidéo. Moonshot AI le présente comme le premier modèle open-weights de la classe des 3 billions de paramètres. Tarif API sur platform.kimi.ai : $3 par million de tokens en entrée (cache-miss), $0,30 en cache-hit, $15 en sortie (août 2026).

Tableau comparatif

Claude Fable 5 vs Kimi K3 — point par point

CritèreClaude Fable 5Kimi K3Gagnant
Prix API entrée / sortie (août 2026)$10 / $50 par million de tokens ; $5 / $25 en batch ; cache-read à $1$3 / $15 par million de tokens ; cache-hit à $0,30 Kimi K3
Benchmarks publiés (tableau Moonshot AI)FrontierSWE 86,6 ; OSWorld 2.0 66,1 ; Terminal-Bench 2.1 88,0 ; GPQA Diamond 92,6FrontierSWE 81,2 ; OSWorld 2.0 58,3 ; Terminal-Bench 2.1 88,3 ; GPQA Diamond 93,5
Poids ouverts vs propriétairePropriétaire : aucun accès aux poids, pas d'audit ni de fine-tuningPoids ouverts sur Hugging Face (moonshotai/Kimi-K3), licence Kimi K3 Kimi K3
Auto-hébergementImpossible : API et clouds partenaires uniquementPossible mais lourd : environ 1,5 To de poids, nœud multi-GPU de datacenter requis Kimi K3
Sécurité et alignementClassifieurs de sécurité ; bug bounty externe sans jailbreak universel en plus de 1 000 heures de testPas de dispositif équivalent documenté publiquement ; les poids ouverts se déploient sans garde-fous imposés Claude Fable 5
RGPD et localisation des donnéesEndpoints régionaux UE sur Bedrock et Vertex AI ; DPA publié ; pas d'entraînement sur les contenus ; rétention de 30 jours à documenterServeurs à Singapour ; « garanties appropriées » sans mécanisme nommé ; textes contradictoires sur l'usage des contenus pour l'entraînement Claude Fable 5
Souveraineté numériqueSociété américaine : Cloud Act applicable même en région UE ; service suspendu 19 jours en juin 2026 sur ordre d'export-controlSociété chinoise : le droit chinois s'applique au fournisseur
Qualité en françaisExcellente selon notre expérience projet : rédaction et analyse de niveau seniorBonne selon notre expérience projet ; peu de benchmarks francophones publiés Claude Fable 5
Fenêtre de contexte1 million de tokens, 128 000 tokens en sortie, tarif standard sans palier1 048 576 tokens, tarif plat sans surcoût long-contexte
Agents et appels d'outilsOSWorld 2.0 à 66,1 ; Claude Code et connecteurs MCP natifsMCPMark-Verified à 94,5 contre 87,4 ; BrowseComp à 91,2 contre 88,0 Kimi K3
Écosystème et intégrationsAWS Bedrock, Google Vertex AI, Microsoft Foundry, Claude Code, connecteurs MCPplatform.kimi.ai, Together AI, OpenRouter, poids sur Hugging Face ; offre entreprise jeune en Europe Claude Fable 5
Coût total pour une PME françaiseAPI chère ; endpoints régionaux UE majorés d'environ 10 % ; batch et cache pour amortirAPI très compétitive ; cadre juridique RGPD à construire soi-même ; auto-hébergement hors budget PME
Forces et faiblesses

Ce que chacun fait bien (ou mal)

Claude Fable 5

Ce qui est fort
  • Traitement batch à $5 / $25 par million de tokens : moitié prix sur tous les volumes différés
  • Endpoints régionaux AWS Bedrock et Google Vertex AI : stockage et inférence garantis dans la région choisie, Europe incluse
  • Devant Kimi K3 sur FrontierSWE (86,6 contre 81,2) et OSWorld 2.0 (66,1 contre 58,3) — y compris dans le tableau publié par Moonshot AI
  • Bug bounty externe : aucun jailbreak universel en plus de 1 000 heures de test, selon Anthropic
  • Fenêtre d'un million de tokens et 128 000 tokens de sortie, au tarif standard sans palier long-contexte
  • Écosystème mature : Claude Code, connecteurs MCP, DPA et documentation de conformité publiées
Ce qui coince
  • Cher : $10 / $50 par million de tokens, soit 3,3 fois le tarif de Kimi K3 en entrée comme en sortie
  • Propriétaire : aucun accès aux poids, ni fine-tuning ni audit interne possibles
  • Rétention obligatoire de 30 jours de tout le trafic des modèles de classe Mythos, Fable 5 compris
  • Classifieurs de sécurité : moins de 5 % des sessions basculent vers Opus 4.8, mais la bascule existe
  • Pas de résidence UE sur l'API directe Anthropic : il faut passer par Bedrock ou Vertex AI, dont les endpoints régionaux sont majorés d'environ 10 %
  • Anthropic est une société américaine : le Cloud Act s'applique même en région UE, et un ordre d'export-control américain a déjà suspendu Fable 5 et Mythos 5 pendant 19 jours en juin 2026

Kimi K3

Ce qui est fort
  • Poids ouverts sur Hugging Face : audit, fine-tuning et déploiement sur votre propre infrastructure
  • Tarif API : $3 / $15 par million de tokens, 3,3 fois moins cher que Fable 5, avec un cache-hit à $0,30
  • Devant Fable 5 sur BrowseComp (91,2 contre 88,0), MCPMark-Verified (94,5 contre 87,4) et SWE-Marathon (42,0 contre 35,0)
  • Fenêtre d'un million de tokens à tarif plat, sans surcoût long-contexte
  • Architecture MoE efficiente : 104 milliards de paramètres actifs seulement, support dès le premier jour sur vLLM et SGLang
  • API compatible OpenAI et Anthropic : migration d'un projet existant sans réécriture
Ce qui coince
  • Auto-hébergement hors de portée d'une PME : environ 1,5 To de poids et un nœud multi-GPU de datacenter au minimum
  • API hébergée à Singapour : transfert hors EEE dont le mécanisme n'est pas nommé dans la politique de confidentialité
  • Textes officiels contradictoires sur l'usage des contenus : la politique de confidentialité les range parmi ce qui sert à « optimiser les modèles », quand la page d'aide API promet l'absence d'entraînement par défaut
  • Licence Kimi K3 sur mesure : libre pour l'essentiel des usages, mais accord commercial requis pour un service de modèle hébergé dès 20 M$ de revenus sur 12 mois — tous revenus de l'entreprise et de ses affiliés confondus —, et attribution obligatoire à très grande échelle
  • Moonshot AI est une société chinoise : l'analyse de risque fournisseur doit intégrer le droit chinois
  • Écosystème entreprise plus jeune en Europe : support, contrats et intégrations moins établis qu'Anthropic
Qui doit choisir quoi

Verdict par profil

PME traitant des données clients ou RH

Claude Fable 5

Endpoints régionaux UE, DPA publié, pas d'entraînement sur vos contenus : Fable 5 via Bedrock ou Vertex AI est le choix le plus simple à défendre devant la CNIL. L'API Kimi K3, servie depuis Singapour avec des textes officiels contradictoires sur l'usage des contenus, impose un chantier juridique avant le premier appel.

Équipe technique avec budget contraint

Kimi K3

À $3 / $15 par million de tokens, Kimi K3 coûte 3,3 fois moins cher que Fable 5, en entrée comme en sortie. Sur de gros volumes de documents ou de code, l'écart est décisif — à condition de ne pas y envoyer de données personnelles.

DSI cherchant à auto-héberger un modèle frontier

Kimi K3

Kimi K3 est le seul des deux à publier ses poids. L'exercice reste exigeant — environ 1,5 To de poids et un nœud multi-GPU de datacenter — mais il est possible ; avec Fable 5, il ne l'est pas du tout.

Agence ou ESN développant des agents IA complexes

Claude Fable 5

Claude Code, connecteurs MCP et un score OSWorld 2.0 de 66,1 contre 58,3 : pour des agents qui pilotent réellement un environnement, l'outillage et la fiabilité documentée de Fable 5 priment, même si Kimi K3 mène sur MCPMark-Verified.

Chercheur ou développeur indépendant

Kimi K3

Poids ouverts, fine-tuning possible, API à bas coût pour itérer : Kimi K3 offre tout ce que Fable 5 refuse par construction. Le tarif d'entrée à $3 et le cache-hit à $0,30 rendent l'expérimentation abordable.

Cas d'usage concrets

Scénarios réels — qui gagne ?

Claude Fable 5

Traitement automatisé de contrats et documents RH contenant des données personnelles

Des données de salariés ou de clients exigent une base légale et une localisation maîtrisée. Fable 5 via les endpoints régionaux UE de Bedrock ou Vertex AI répond aux deux, avec un DPA et sans entraînement sur vos contenus. L'API Kimi K3 stocke à Singapour et ses textes officiels se contredisent sur l'usage des contenus : c'est un risque CNIL, pas un détail.

Kimi K3

Génération et revue de code sur une base de code volumineuse

Sans données personnelles, le rapport performance/prix de Kimi K3 est imbattable : 81,2 sur FrontierSWE, 42,0 sur SWE-Marathon, pour un tarif 3,3 fois inférieur à Fable 5. À volume élevé, l'économie se chiffre en milliers de dollars par an.

Kimi K3

Agent de recherche documentaire et veille sectorielle

Kimi K3 mène sur BrowseComp (91,2 contre 88,0) et DeepSearchQA (95,0 contre 94,2 en score F1). Sur de la recherche intensive sans données personnelles, il est au moins aussi performant que Fable 5 et nettement moins coûteux.

Claude Fable 5

Automatisation de workflows internes avec outils métier (CRM, ERP, messagerie)

Claude Code, les connecteurs MCP et la disponibilité sur Bedrock, Vertex AI et Microsoft Foundry donnent à Fable 5 un écosystème prêt à l'emploi dans les environnements cloud des PME françaises. Kimi K3 expose une API compatible OpenAI et Anthropic, mais son offre entreprise reste jeune en Europe.

FAQ

Questions fréquentes

Kimi K3 est-il conforme au RGPD pour une utilisation en entreprise française ?

Non, pas sans travail juridique. L'API de Kimi K3 est servie depuis des serveurs situés à Singapour, et la politique de confidentialité de Moonshot AI range les contenus envoyés parmi les données qui servent à « optimiser les modèles », quand d'autres pages de l'éditeur promettent l'absence d'entraînement par défaut — une contradiction que seul un contrat signé peut trancher. Pour des données personnelles de clients ou de salariés, il faut donc un mécanisme de transfert hors EEE valide et un encadrement contractuel que l'éditeur ne fournit pas clé en main. La voie la plus propre reste l'auto-hébergement des poids ouverts sur une infrastructure européenne — mais elle exige un nœud multi-GPU de datacenter. Notre analyse détaillée : Kimi K3, l'évaluation sécurité pour les PME.

Claude Fable 5 est-il vraiment conforme au RGPD ?

Pas automatiquement. L'API directe d'Anthropic route les requêtes globalement par défaut ; la seule option de résidence documentée sur l'API first-party est américaine. En revanche, via les endpoints régionaux d'AWS Bedrock ou de Google Vertex AI, stockage et inférence restent dans la région choisie, Europe comprise, moyennant une majoration d'environ 10 %. Anthropic publie un DPA et n'utilise pas les données de l'API pour entraîner ses modèles, mais impose une rétention de 30 jours sur les modèles de classe Mythos, Fable 5 compris — à documenter dans votre registre de traitements. Pour élargir la comparaison : ChatGPT vs Claude vs Gemini en entreprise.

Quelle est la différence de prix réelle entre les deux modèles ?

En tarif standard, Kimi K3 est 3,3 fois moins cher que Fable 5, en entrée ($3 contre $10 par million de tokens) comme en sortie ($15 contre $50). Sur un volume mensuel de 10 millions de tokens en entrée et 2 millions en sortie, cela donne environ $60 par mois pour Kimi K3 contre $200 pour Fable 5, soit $1 680 d'écart par an. Le cache-hit de Kimi K3 à $0,30 par million de tokens et le batch de Fable 5 à moitié prix ($5 / $25) resserrent l'écart selon le profil d'usage. Tarifs relevés en août 2026 sur les pages officielles des deux éditeurs.

Peut-on auto-héberger Kimi K3 dans une PME française ?

En pratique, non. Le dépôt Hugging Face de Kimi K3 pèse environ 1,5 To (poids en MXFP4), et les guides des moteurs d'inférence recommandés (vLLM, SGLang) partent d'un nœud multi-GPU de dernière génération — une infrastructure de datacenter, pas un serveur de PME. La licence l'autorise, le budget rarement. Pour garder la maîtrise de vos données sans ce niveau d'investissement, un déploiement encadré via API reste plus réaliste. Nos services en intelligence artificielle couvrent ce type d'arbitrage d'architecture.

Lequel des deux modèles est le meilleur pour le code ?

Les deux sont au niveau frontier, avec des profils différents. Sur le tableau publié par Moonshot AI, Fable 5 mène sur FrontierSWE (86,6 contre 81,2) ; Kimi K3 mène nettement sur SWE-Marathon (42,0 contre 35,0) ; Terminal-Bench 2.1 est un quasi match nul (88,3 contre 88,0). Pour du code en gros volume sans données personnelles, le rapport coût/performance de Kimi K3 est difficile à battre. Pour des agents de codage longue durée et outillés, Fable 5 et Claude Code forment l'ensemble le plus mature.

Quelle est la différence entre Claude Fable 5 et Claude Mythos 5 ?

Le même modèle, deux contrôles d'accès. Fable 5 est la version généralement accessible : des classifieurs de sécurité y renvoient les requêtes sensibles (cybersécurité, biologie et chimie, distillation de modèles) vers Claude Opus 4.8 — moins de 5 % des sessions selon Anthropic. Mythos 5 s'en passe, mais n'est disponible que sur invitation : partenaires du programme de cyberdéfense Glasswing — une coalition d'industriels réunie par Anthropic — puis, à terme, des chercheurs en biologie sélectionnés. Les deux sont facturés $10 / $50 par million de tokens. Pour une PME, le choix se réduit donc à Fable 5.

Comment choisir entre les deux modèles pour mon projet ?

Deux questions suffisent. Vos données contiennent-elles des informations personnelles au sens du RGPD ? Si oui, Fable 5 via les régions européennes de Bedrock ou Vertex AI est le choix le plus simple à défendre. Votre budget API est-il le facteur limitant ? Si oui, et que vos données sont anonymisées ou non personnelles, Kimi K3 offre un rapport performance/prix difficile à battre. Beaucoup d'organisations combinent les deux : le modèle ouvert pour le volume, le modèle encadré pour le sensible. Pour trancher sur votre cas précis, parlez-en avec notre équipe.

Comparatif publié le , revu en . Une donnée vous semble dépassée ? Signalez-la nous — on corrige et on redate. Notre méthode de comparaison est publique.

Vérifiable

Sources

Les chiffres de marché, seuils réglementaires et seuils de performance de cette page renvoient à leur source primaire — l'éditeur, le régulateur ou l'auteur de l'étude, jamais un intermédiaire. Chaque lien a été vérifié à la date indiquée. Notre méthode explique ce que nous faisons quand aucune source solide n'existe.

  1. Anthropic

    Introducing Claude Fable 5 and Claude Mythos 5

    Lancement le 9 juin 2026, tarif $10 / $50 par million de tokens, rétention obligatoire de 30 jours sur les modèles de classe Mythos, fallback vers Opus 4.8 sur moins de 5 % des sessions, bug bounty sans jailbreak universel en plus de 1 000 heures, programme Glasswing, suspension du 12 juin au 1er juillet 2026 sur ordre d'export-control.

    Lien et donnée vérifiés le .

  2. Anthropic — documentation Claude Platform

    Pricing

    Tarifs détaillés Fable 5 : batch $5 / $25, cache write $12,50, cache read $1 par million de tokens ; contexte 1M au tarif standard ; endpoints régionaux Bedrock et Vertex AI majorés de 10 %.

    Lien et donnée vérifiés le .

  3. Anthropic — documentation Claude Platform

    Models overview

    Fenêtre de contexte d'un million de tokens et 128 000 tokens de sortie pour Fable 5 ; disponibilité générale sur API Claude, AWS Bedrock, Google Vertex AI et Microsoft Foundry depuis le 9 juin 2026 ; Mythos 5 en disponibilité limitée via Glasswing.

    Lien et donnée vérifiés le .

  4. Moonshot AI — fiche modèle Hugging Face

    Kimi-K3

    Architecture MoE 2 800 milliards de paramètres dont 104 milliards actifs (896 experts, 16 par token), contexte de 1 048 576 tokens, entrées texte, image et vidéo, licence Kimi K3, poids MXFP4 (dépôt d'environ 1,5 To), tableau complet des benchmarks face à Claude Fable 5.

    Lien et donnée vérifiés le .

  5. Moonshot AI — documentation platform.kimi.ai

    Kimi K3 Pricing

    Tarifs kimi-k3 : $3 par million de tokens en entrée (cache-miss), $0,30 en cache-hit, $15 en sortie ; tarification plate sur toute la fenêtre de contexte (août 2026).

    Lien et donnée vérifiés le .

  6. Moonshot AI

    Kimi OpenPlatform Privacy Policy

    Serveurs situés à Singapour, utilisation des contenus pour optimiser les modèles (que la page d'aide API contredit), absence de durée de rétention fixe, section RGPD évoquant des « garanties appropriées » sans mécanisme de transfert nommé.

    Lien et donnée vérifiés le .

Besoin d'aide pour trancher ?

On vous accompagne sur le choix et l'implémentation — audit, déploiement, formation. Devis gratuit sous 24 h.

Parler de votre projet

ou découvrez notre expertise Intelligence artificielle pour entreprise