IA

Claude, Kimi ou ChatGPT : l'autonomie, le prix ou l'écosystème ?

Trois modèles frontier, trois philosophies. Claude Fable 5 mise sur le travail autonome de longue durée, fermé et encadré. Kimi K3 publie ses poids et casse les prix de l'API. ChatGPT GPT-5.6 aligne trois variantes tarifaires et l'écosystème grand public le plus large. Données vérifiées au 19 août 2026, benchmarks issus du tableau publié par Moonshot AI : voici comment trancher pour votre PME.

Parler de votre projet
Verdict express

Pas de champion unique : trois gagnants selon le besoin. Claude Fable 5 ($10/$50 par million de tokens, août 2026) domine l'ingénierie logicielle de pointe (FrontierSWE 86,6 contre 81,2 et 71,3) et le travail professionnel évalué (GDPval-AA v2 : Elo 1747) ; c'est le modèle des agents autonomes de longue durée, au prix d'une API chère et d'une rétention obligatoire de 30 jours. Kimi K3 ($3/$15, cache-hit à $0,30) est le frontier le moins cher et le seul en poids ouverts ; il mène sur BrowseComp (91,2) et MCPMark-Verified (94,5), mais son API est servie depuis Singapour par une entreprise chinoise, qui n'exclut l'entraînement sur vos contenus que par accord écrit — un chantier juridique avant toute donnée personnelle. ChatGPT GPT-5.6 offre la gamme la plus flexible (Sol $5/$30, Terra $2/$12, Luna $0,20/$1,20), le meilleur score GPQA Diamond des trois (94,1) et une résidence des données en Europe sur l'API ; l'abonnement Plus à $20/mois reste le point d'entrée le plus simple pour une PME sans DSI. Verdict court : agents autonomes complexes, Fable 5 ; gros volumes au meilleur prix frontier, Kimi K3 ; usage quotidien et déploiement rapide, ChatGPT.

Les acteurs en présence

Qui est qui en 2026 ?

Claude (Fable 5)

Le modèle des agents autonomes de longue durée

Claude Fable 5 est généralement disponible depuis le 9 juin 2026 sur l'API Claude, AWS Bedrock, Google Vertex AI et Microsoft Foundry — après une suspension du 12 juin au 1er juillet 2026 sur ordre d'export-control américain. Son API est facturée $10 par million de tokens en entrée et $50 en sortie (août 2026), moitié prix en batch ($5/$25), avec un cache-read à $1. La fenêtre de contexte atteint un million de tokens à tarif plat, avec 128 000 tokens de sortie. Une rétention de 30 jours s'applique à tout le trafic des modèles de classe Mythos, Fable 5 compris, sur les surfaces first-party comme partenaires.

Kimi (K3)

Le frontier open-weights au meilleur prix API

Kimi K3 est mis en service sur l'API de Moonshot AI le 16 juillet 2026, puis ses poids sont publiés sur Hugging Face (moonshotai/Kimi-K3) fin juillet 2026 sous licence Kimi K3. C'est un MoE de 2 800 milliards de paramètres, dont 104 milliards actifs par token (896 experts, 16 par token), avec une fenêtre de 1 048 576 tokens et des entrées texte, image et vidéo. Tarif API : $3 par million de tokens en entrée (cache-miss), $0,30 en cache-hit, $15 en sortie (août 2026). L'API hébergée est opérée par MOONSHOT AI PTE. LTD. depuis des serveurs situés à Singapour.

ChatGPT (GPT-5.6)

La gamme la plus flexible, du gratuit au frontier

La famille GPT-5.6 d'OpenAI est en service depuis juillet 2026 et se décline en trois variantes API : Sol ($5/$30 par million de tokens), Terra ($2/$12) et Luna ($0,20/$1,20), toutes avec 1 050 000 tokens de contexte et 128 000 tokens de sortie ; le Batch API divise ces tarifs par deux (août 2026). Depuis la mise à jour du 6 août 2026, Luna est le modèle par défaut des plans Free et Go, et les abonnés Plus ($20/mois) et Pro ($200/mois) disposent de Sol avec un curseur d'effort. La résidence des données en Europe est disponible sur l'API pour les nouveaux projets éligibles.

Tableau comparatif

Claude (Fable 5) vs Kimi (K3) vs ChatGPT (GPT-5.6) — point par point

CritèreClaude (Fable 5)Kimi (K3)ChatGPT (GPT-5.6)Gagnant
Abonnement grand public — entrée de gammeGratuit (limité) ou Pro à $20/moisModerato à $19/mois ($15/mois en annuel)Gratuit (Luna) ou Go à $8/mois ChatGPT (GPT-5.6)
Abonnement grand public — haut de gammeMax à partir de $100/mois (paliers 5x et 20x l'usage Pro)Vivace à $199/mois ($159/mois en annuel)Pro à $200/mois
Prix API du modèle frontier (entrée/sortie, août 2026)$10 / $50 par MTok ; batch $5/$25 ; cache-read $1$3 / $15 par MTok ; cache-hit $0,30Sol : $5 / $30 par MTok ; batch $2,50/$15 ; cache $0,50 Kimi (K3)
Gamme de variantes économiquesAucune dans la classe Fable ; il faut passer à Opus 5 ($5/$25), Sonnet 5 ($2/$10) ou Haiku 4.5 ($1/$5)Tarif unique, amorti par le cache-hit à $0,30Terra à $2/$12 et Luna à $0,20/$1,20 dans la même famille, batch à moitié prix ChatGPT (GPT-5.6)
Raisonnement scientifique (GPQA Diamond)92,693,594,1 (Sol) ChatGPT (GPT-5.6)
Ingénierie logicielle de pointe (FrontierSWE)86,681,271,3 (Sol) Claude (Fable 5)
Travail professionnel évalué (GDPval-AA v2, Elo)174716861736 (Sol) Claude (Fable 5)
Recherche web agentique (BrowseComp)88,091,290,4 (Sol) Kimi (K3)
Agents et outils MCP (MCPMark-Verified)87,494,592,9 (Sol) Kimi (K3)
Open-weights vs propriétairePropriétaire : aucun accès aux poidsPoids ouverts sur Hugging Face, licence Kimi K3Propriétaire : aucun accès aux poids Kimi (K3)
RGPD et résidence des données UEEndpoints régionaux UE via Bedrock et Vertex AI (+10 %) ; API first-party globale par défaut ; rétention 30 jours à documenterServeurs à Singapour, mécanisme de transfert non nommé, entraînement sur les contenus sauf accord écrit séparéRésidence Europe sur l'API (nouveau projet, eu.api.openai.com, approbation requise, majoration de 10 %) ; côté ChatGPT, réservée à Enterprise ChatGPT (GPT-5.6)
Souveraineté numériqueSociété américaine : Cloud Act ; service suspendu 19 jours en juin 2026 sur ordre d'export-controlSociété chinoise : droit chinois applicable au fournisseur ; l'auto-hébergement réduit l'exposition à l'APISociété américaine : Cloud Act, y compris sur les données résidant en Europe
Multimodal (entrées acceptées)Texte et imageTexte, image et vidéo dans le même modèleTexte et image (les trois variantes) Kimi (K3)
Fenêtre de contexte et coût long-contexte1 M tokens à tarif plat, mais tokenizer produisant ~30 % de tokens en plus1 048 576 tokens à tarif plat1 050 000 tokens, majorés 2x en entrée et 1,5x en sortie au-delà de 272 000 tokens d'entrée Kimi (K3)
Forces et faiblesses

Ce que chacun fait bien (ou mal)

Claude (Fable 5)

Ce qui est fort
  • FrontierSWE à 86,6 : meilleur score des trois sur l'ingénierie logicielle de pointe, y compris dans le tableau publié par Moonshot AI.
  • Premier des trois sur le travail professionnel évalué : GDPval-AA v2 à 1747 Elo, contre 1736 pour GPT-5.6 Sol et 1686 pour Kimi K3.
  • Travail autonome de longue durée documenté par Anthropic — jusqu'à plus d'une semaine sur un projet de génomique pour Mythos 5, la déclinaison sans classifieurs de la même classe — avec outil de mémoire persistante et vérification visuelle de ses propres sorties.
  • Fenêtre d'un million de tokens à tarif standard, sans palier long-contexte — là où GPT-5.6 majore au-delà de 272 000 tokens d'entrée.
  • Endpoints régionaux UE sur AWS Bedrock et Google Vertex AI : stockage et inférence garantis dans la région choisie, moyennant environ 10 % de majoration.
  • Écosystème agentique mature : Claude Code, connecteurs MCP, disponibilité premier jour sur Bedrock, Vertex AI et Microsoft Foundry.
Ce qui coince
  • API la plus chère des trois : $10/$50 par million de tokens, contre $3/$15 pour Kimi K3 et $5/$30 pour GPT-5.6 Sol (août 2026).
  • Son tokenizer produit environ 30 % de tokens en plus pour le même texte que les générations précédentes : le coût réel par document est supérieur au tarif affiché.
  • Rétention obligatoire de 30 jours sur les modèles de classe Mythos, surfaces first-party et partenaires comprises.
  • Classifieurs de sécurité actifs : moins de 5 % des sessions basculent vers Opus 4.8, mais la bascule existe (cybersécurité, biologie-chimie, distillation).
  • Pas de résidence UE sur l'API first-party : routage global par défaut, seule l'option États-Unis est proposée (majorée de 1,1x) ; l'Europe passe par Bedrock ou Vertex AI.
  • Propriétaire, sans variante économique dans la même classe : réduire la facture impose de changer de modèle (Opus 5 à $5/$25, Sonnet 5 à $2/$10, Haiku 4.5 à $1/$5).

Kimi (K3)

Ce qui est fort
  • Prix API frontier le plus bas des trois : $3/$15 par million de tokens, avec un cache-hit à $0,30 (août 2026).
  • Seul des trois en poids ouverts (Hugging Face, moonshotai/Kimi-K3) : audit, fine-tuning et déploiement sur votre propre infrastructure.
  • BrowseComp à 91,2 et MCPMark-Verified à 94,5 : meilleurs scores des trois sur la recherche web agentique et l'usage d'outils MCP.
  • SWE-Marathon à 42,0, devant Fable 5 (35,0) et GPT-5.6 Sol (39,0) : endurance sur les tâches de code longues.
  • Seul des trois à accepter la vidéo en entrée, en plus du texte et de l'image, dans le même modèle.
  • Fenêtre de 1 048 576 tokens à tarif plat ; API compatible OpenAI et Anthropic, support premier jour sur vLLM et SGLang.
Ce qui coince
  • API servie depuis Singapour : transfert hors EEE dont le mécanisme n'est pas nommé dans la politique de confidentialité.
  • Entraînement sur les contenus par défaut : la politique de confidentialité les range parmi ce qui sert à « optimiser les modèles », et les conditions d'utilisation de l'API ne l'excluent que par accord écrit séparé — seule l'offre entreprise promet l'absence d'entraînement.
  • Moonshot AI est une société chinoise : l'analyse de risque fournisseur doit intégrer le droit chinois, quel que soit le lieu des serveurs.
  • FrontierSWE à 81,2 et GDPval-AA v2 à 1686 Elo : en retrait de Claude Fable 5 sur le code de pointe et le travail professionnel évalué.
  • Auto-hébergement hors de portée d'une PME seule : environ 1,5 To de poids et un nœud multi-GPU de datacenter au minimum.
  • Licence sur mesure : accord commercial requis dès 20 M$ de revenus sur 12 mois pour un service de modèle hébergé ; écosystème entreprise encore jeune en Europe.

ChatGPT (GPT-5.6)

Ce qui est fort
  • GPQA Diamond à 94,1 et Terminal-Bench 2.1 à 88,8 pour Sol : meilleurs scores des trois sur ces deux benchmarks (tableau publié par Moonshot AI).
  • Gamme tarifaire la plus large : de Luna à $0,20/$1,20 jusqu'à Sol à $5/$30, batch à moitié prix (Luna en batch : $0,10/$0,60 par million de tokens).
  • Résidence des données en Europe sur l'API : stockage et traitement régionaux via eu.api.openai.com pour les nouveaux projets éligibles, moyennant 10 % de majoration ; zéro-rétention possible sur approbation.
  • Les données envoyées à l'API ne servent pas à entraîner les modèles par défaut, sans démarche particulière.
  • Écosystème grand public sans équivalent : ChatGPT de Free à Pro ($200/mois), Codex, ChatGPT Work, et GPT-5.6 comme modèle préférentiel de Microsoft 365 Copilot depuis juillet 2026.
  • Depuis le 6 août 2026, Sol est livré dans ChatGPT Plus et Pro avec un curseur d'effort, avec environ 60 % de réponses contenant une erreur factuelle en moins que GPT-5.5 Instant, selon OpenAI.
Ce qui coince
  • Surcharge long-contexte : au-delà de 272 000 tokens d'entrée, le prix passe à 2x en entrée et 1,5x en sortie — la fenêtre de 1 050 000 tokens se paie, contrairement à Fable 5 et K3.
  • FrontierSWE à 71,3 pour Sol : nettement derrière Claude Fable 5 (86,6) et Kimi K3 (81,2) sur l'ingénierie logicielle de pointe.
  • La résidence UE de l'API exige un nouveau projet, un amendement de rétention et une approbation ; côté produit ChatGPT, elle est réservée à l'offre Enterprise.
  • Aucune option open-weights : dépendance totale à l'infrastructure d'OpenAI.
  • Société américaine : le Cloud Act s'applique, y compris aux données stockées en Europe.
  • Complexité de gamme : trois variantes API, plus des versions de juillet et d'août qui coexistent dans Codex et ChatGPT Work — choisir demande une évaluation préalable.
Qui doit choisir quoi

Verdict par profil

Dirigeant de PME sans DSI

ChatGPT (GPT-5.6)

ChatGPT Plus à $20/mois donne accès à GPT-5.6 Sol sans aucune configuration technique, dans une interface que vos équipes connaissent déjà. GPT-5.6 est aussi le modèle préférentiel de Microsoft 365 Copilot, souvent déjà présent dans l'entreprise. C'est le chemin le plus court entre une intention et un résultat.

Développeur freelance ou lead tech

ChatGPT (GPT-5.6)

La gamme Sol/Terra/Luna couvre tous les niveaux de complexité sans changer de fournisseur : Luna à $0,20/$1,20 par million de tokens pour prototyper et absorber le volume, Sol à $5/$30 pour les tâches exigeantes, batch à moitié prix partout (août 2026). Un seul compte, trois régimes de coût.

Responsable juridique ou DPO

ChatGPT (GPT-5.6)

L'API d'OpenAI propose une résidence des données en Europe — stockage et traitement via eu.api.openai.com, moyennant 10 % de majoration — sur les nouveaux projets éligibles, et n'entraîne pas ses modèles sur les données API par défaut. Claude Fable 5 reste défendable via les régions UE de Bedrock ou Vertex AI, avec une rétention de 30 jours à documenter. L'API Kimi K3, servie depuis Singapour et dont les conditions n'excluent l'entraînement sur vos contenus que par accord écrit séparé, impose un chantier juridique avant le premier appel.

Équipe technique souhaitant maîtriser son infrastructure

Kimi (K3)

Kimi K3 est le seul des trois disponible en poids ouverts (Hugging Face, moonshotai/Kimi-K3). L'auto-hébergement supprime l'exposition à l'API hébergée — au prix d'environ 1,5 To de poids et d'un nœud multi-GPU de datacenter. C'est la seule option qui combine performances frontier et contrôle total des données à l'inférence.

Chef de projet ou responsable R&D sur des tâches longues

Claude (Fable 5)

Anthropic est le seul des trois éditeurs à documenter du travail autonome de plusieurs jours sur cette classe de modèles — une semaine de recherche génomique menée par Mythos 5, dont Fable 5 est la version publique — avec mémoire persistante et vérification visuelle des sorties. Ses scores FrontierSWE (86,6) et GDPval-AA v2 (Elo 1747) sont les meilleurs de la comparaison : pour des automatisations complexes à supervision minimale, il est devant.

Startup ou intégrateur optimisant le coût par requête frontier

Kimi (K3)

À $3/$15 par million de tokens avec un cache-hit à $0,30, Kimi K3 coûte trois fois moins cher que Fable 5 en entrée comme en sortie, et reste devant Sol sur BrowseComp (91,2) et MCPMark-Verified (94,5). Pour du volume sur des données non personnelles, le rapport performance/prix est difficile à battre.

Cas d'usage concrets

Scénarios réels — qui gagne ?

Claude (Fable 5)

Automatisation de la revue de code sur un dépôt de grande taille

Claude Fable 5 mène sur FrontierSWE (86,6 contre 81,2 et 71,3) et Anthropic documente jusqu'à une semaine de travail autonome sur cette classe de modèles, avec mémoire persistante. Associé à Claude Code et aux connecteurs MCP, c'est l'ensemble le plus mature pour des agents de code longue durée — à condition d'accepter le tarif de $10/$50 par million de tokens.

Kimi (K3)

Agent de recherche web et veille concurrentielle

Kimi K3 affiche le meilleur BrowseComp des trois (91,2 contre 90,4 pour Sol et 88,0 pour Fable 5), pour un coût par requête trois fois inférieur à Fable 5. Sur de la veille intensive sans données personnelles, c'est l'option la plus rentable ; gardez les données clients hors de l'API hébergée.

ChatGPT (GPT-5.6)

Traitement en volume de documents (factures, contrats, rapports)

GPT-5.6 Luna accepte les images en entrée et tombe à $0,10/$0,60 par million de tokens en Batch API (août 2026). Pour des milliers de documents par mois, aucune des deux autres options n'approche ce coût marginal — Fable 5 est 50 fois plus cher en batch, et Kimi K3 n'a pas d'équivalent économique dans sa gamme.

Kimi (K3)

Agent interne connecté à vos outils métier via MCP

Kimi K3 domine MCPMark-Verified (94,5 contre 92,9 pour Sol et 87,4 pour Fable 5) et son API est compatible avec les formats OpenAI et Anthropic, ce qui simplifie la migration d'un agent existant. En auto-hébergement, c'est aussi la seule option où vos connecteurs et vos données ne quittent jamais votre infrastructure.

ChatGPT (GPT-5.6)

Assistant IA quotidien pour une équipe de 5 à 20 personnes

ChatGPT Plus à $20/mois par utilisateur donne accès à Sol avec curseur d'effort ; ChatGPT Business existe à $20/utilisateur/mois en facturation annuelle. Interface connue, déploiement immédiat, et GPT-5.6 déjà présent dans Microsoft 365 Copilot : pour un usage bureautique généraliste, c'est le choix le plus rapide à mettre en place.

FAQ

Questions fréquentes

Quelle IA choisir pour une PME française en 2026 ?

Pour la majorité des PME sans équipe technique dédiée, ChatGPT est le point de départ le plus pragmatique : abonnement Plus à $20/mois avec GPT-5.6 Sol, gamme API de $0,20 à $5 par million de tokens en entrée (août 2026), et résidence des données en Europe possible sur l'API. Si votre priorité est le coût par requête frontier ou la maîtrise de l'infrastructure, Kimi K3 mérite une évaluation sérieuse — avec un partenaire technique pour le volet RGPD. Claude Fable 5 s'impose pour les automatisations complexes de longue durée. Nos consultants peuvent cadrer votre besoin : découvrez notre accompagnement IA pour PME.

Claude Fable 5 est-il conforme au RGPD pour une entreprise française ?

Pas automatiquement. L'API first-party d'Anthropic route les requêtes globalement par défaut ; la seule résidence documentée sur cette surface est américaine. Via les endpoints régionaux d'AWS Bedrock ou de Google Vertex AI, stockage et inférence restent dans la région choisie, Europe comprise, moyennant environ 10 % de majoration. Anthropic publie un DPA et n'entraîne pas ses modèles sur les données de l'API, mais impose une rétention de 30 jours sur les modèles de classe Mythos, Fable 5 compris — à documenter dans votre registre de traitements. Notre analyse détaillée : Claude Fable 5 vs Kimi K3.

Kimi K3 est-il sûr pour traiter des données d'entreprise ?

Pas en l'état pour des données personnelles. L'API est opérée par MOONSHOT AI PTE. LTD. depuis des serveurs situés à Singapour, et les textes officiels de Moonshot AI ne protègent pas vos contenus par défaut : la politique de confidentialité les range parmi ce qui sert à « optimiser les modèles », et les conditions d'utilisation de l'API réservent toute restriction d'entraînement à un accord écrit séparé — seule l'offre entreprise promet que les données ne servent jamais à l'entraînement. Moonshot AI restant une société chinoise, l'analyse de risque fournisseur doit intégrer le droit chinois. L'auto-hébergement des poids ouverts supprime l'exposition à l'API, sans changer ce statut juridique. Notre évaluation complète : Kimi K3, l'évaluation sécurité pour les PME.

Quelle est la différence entre GPT-5.6 Sol, Terra et Luna ?

Les trois variantes partagent la même fenêtre de contexte (1 050 000 tokens, 128 000 en sortie) et acceptent texte et image, mais diffèrent par la puissance et le coût (août 2026). Sol ($5/$30 par million de tokens) est le flagship : 94,1 sur GPQA Diamond et 88,8 sur Terminal-Bench 2.1, meilleurs scores de cette comparaison. Terra ($2/$12), disponible via l'API, est le choix équilibré pour la production quotidienne. Luna ($0,20/$1,20) vise les volumes élevés ; c'est le modèle par défaut des plans Free et Go depuis le 6 août 2026. Attention au long contexte : au-delà de 272 000 tokens d'entrée, les trois variantes sont majorées 2x en entrée et 1,5x en sortie.

Claude Fable 5 vaut-il son prix par rapport à ChatGPT ?

Sur le code de pointe, oui. Fable 5 coûte deux fois plus cher que GPT-5.6 Sol ($10/$50 contre $5/$30 par million de tokens, août 2026) et son tokenizer produit environ 30 % de tokens en plus pour le même texte. Mais l'écart de performance est réel là où il compte : 86,6 contre 71,3 sur FrontierSWE, et la première place sur GDPval-AA v2 (Elo 1747 contre 1736). Pour des agents de code longue durée, l'écart de prix se justifie ; pour la rédaction, l'analyse ou la recherche quotidiennes, Sol ou Terra offrent un meilleur rapport qualité-prix. Pour élargir : ChatGPT vs Claude vs Gemini pour l'entreprise.

Peut-on auto-héberger Kimi K3 dans son infrastructure ?

Techniquement oui, rarement en pratique pour une PME seule. Les poids complets (MoE de 2 800 milliards de paramètres, 104 milliards actifs par token) sont publiés sur Hugging Face sous licence Kimi K3, qui autorise l'usage commercial — avec un accord séparé requis dès 20 M$ de revenus sur 12 mois pour un service de modèle hébergé. Le dépôt pèse environ 1,5 To et les moteurs d'inférence recommandés (vLLM, SGLang) partent d'un nœud multi-GPU de datacenter. Cette option supprime l'exposition à l'API hébergée, mais exige un vrai partenaire infrastructure. Pour évaluer la faisabilité dans votre contexte, contactez notre équipe.

Quelle IA choisir pour l'automatisation de processus métier ?

Tout dépend de la durée et de la structure des processus. Pour des workflows répétitifs à volume élevé, GPT-5.6 Luna ($0,20/$1,20 par million de tokens, $0,10/$0,60 en batch, août 2026) est l'option la plus économique. Pour des processus longs, peu structurés, exigeant une autonomie sur plusieurs jours, Claude Fable 5 est le seul des trois dont l'éditeur documente ce mode de travail sur sa classe de modèles. Pour des agents connectés à vos outils via MCP au meilleur coût, Kimi K3 domine MCPMark-Verified (94,5). Notre équipe accompagne les PME dans ce choix et son implémentation : voir nos services d'intelligence artificielle.

Mistral est-il une alternative crédible à ces trois modèles ?

Pour une PME française, oui, sur un terrain précis : société française, hébergement européen, modèles open-weights sous licence Apache 2.0 et API moins chère à chaque niveau de gamme. Sur les benchmarks de raisonnement et d'agents les plus exigeants, Claude Fable 5, Kimi K3 et GPT-5.6 Sol jouent en revanche le haut du classement, devant les modèles Mistral, à la date d'août 2026. Mistral est particulièrement pertinent quand la souveraineté prime sur la performance maximale, sans auto-hébergement complexe. Notre comparatif dédié : Mistral vs ChatGPT.

Comparatif publié le , revu en . Une donnée vous semble dépassée ? Signalez-la nous — on corrige et on redate. Notre méthode de comparaison est publique.

Vérifiable

Sources

Les chiffres de marché, seuils réglementaires et seuils de performance de cette page renvoient à leur source primaire — l'éditeur, le régulateur ou l'auteur de l'étude, jamais un intermédiaire. Chaque lien a été vérifié à la date indiquée. Notre méthode explique ce que nous faisons quand aucune source solide n'existe.

  1. Moonshot AI — fiche modèle Hugging Face

    Kimi-K3

    Tableau de benchmarks des trois modèles (GPQA Diamond 93,5/92,6/94,1 ; FrontierSWE 81,2/86,6/71,3 ; BrowseComp 91,2/88,0/90,4 ; MCPMark-Verified 94,5/87,4/92,9 ; GDPval-AA v2 1686/1747/1736 ; Terminal-Bench 2.1, SWE-Marathon, DeepSWE, OSWorld) ; architecture MoE 2,8 T / 104 B actifs, 896 experts, contexte 1 048 576 tokens, entrées texte-image-vidéo, licence Kimi K3, poids MXFP4.

    Lien et donnée vérifiés le .

  2. Anthropic

    Introducing Claude Fable 5 and Claude Mythos 5

    Lancement le 9 juin 2026, bandeaux de suspension du 12 juin et de redéploiement du 1er juillet 2026, tarif $10/$50 par million de tokens, rétention de 30 jours sur les modèles de classe Mythos (surfaces first- et third-party), bascule vers Opus 4.8 sur moins de 5 % des sessions, une semaine de recherche génomique autonome par Mythos 5, outil mémoire et vérification visuelle documentés.

    Lien et donnée vérifiés le .

  3. Anthropic — documentation Claude Platform

    Pricing

    Tarifs Fable 5 : batch $5/$25, cache-read $1, cache-write $12,50 ; contexte 1 M à tarif plat ; endpoints régionaux Bedrock/Vertex majorés de 10 % ; option de résidence US first-party à 1,1x ; tokenizer produisant ~30 % de tokens en plus ; Sonnet 5 à $2/$10 et Haiku 4.5 à $1/$5.

    Lien et donnée vérifiés le .

  4. OpenAI — documentation développeurs

    API Pricing

    Tarifs API GPT-5.6 (août 2026) : Sol $5/$30 (cache $0,50), Terra $2/$12 (cache $0,20), Luna $0,20/$1,20 (cache $0,02) ; Batch API à moitié prix : Sol $2,50/$15, Terra $1/$6, Luna $0,10/$0,60 par million de tokens.

    Lien et donnée vérifiés le .

  5. OpenAI — documentation développeurs

    Your data — data controls in the OpenAI API

    Résidence des données Europe sur l'API : stockage et traitement régionaux via eu.api.openai.com, configurée à la création d'un nouveau projet, amendement de rétention et approbation requis ; zéro-rétention sur approbation ; pas d'entraînement sur les données API par défaut ; journaux de surveillance d'abus conservés jusqu'à 30 jours.

    Lien et donnée vérifiés le .

  6. Moonshot AI — kimi.ai

    Kimi K3 Pricing

    Tarif API Kimi K3 : $3 par million de tokens en entrée (cache-miss), $0,30 en cache-hit, $15 en sortie ; abonnements Moderato $19/mois, Allegretto $39/mois, Allegro $99/mois, Vivace $199/mois en facturation mensuelle ($15/$31/$79/$159 en annuel) — août 2026.

    Lien et donnée vérifiés le .

  7. Anthropic

    Statement on the US government directive to suspend access to Fable 5 and Mythos 5

    Directive d'export-control du gouvernement américain reçue le 12 juin 2026 (suspension de l'accès des ressortissants étrangers à Fable 5 et Mythos 5, au motif d'une technique de contournement des garde-fous cybersécurité), désactivation pour tous les clients — levée suivie du redéploiement le 1er juillet 2026.

    Lien et donnée vérifiés le .

  8. Moonshot AI

    Kimi OpenPlatform Privacy Policy

    Services fournis par MOONSHOT AI PTE. LTD. (Singapour), serveurs situés à Singapour, contenus utilisateurs servant à « optimiser les modèles », transferts transfrontaliers avec « garanties appropriées » sans mécanisme nommé.

    Lien et donnée vérifiés le .

  9. Moonshot AI

    Terms of Service for Kimi OpenPlatform

    Usage des contenus clients pour fournir, maintenir et améliorer les services ; restriction de l'usage pour l'entraînement des modèles uniquement via accord écrit séparé (« Unless otherwise expressly agreed in writing, Customer Content may be used for the foregoing purposes »).

    Lien et donnée vérifiés le .

Besoin d'aide pour trancher ?

On vous accompagne sur le choix et l'implémentation — audit, déploiement, formation. Devis gratuit sous 24 h.

Parler de votre projet

ou découvrez notre expertise Intelligence artificielle pour entreprise