Moonshot AI publie aujourd'hui les poids complets de Kimi K3 — le plus grand modèle open-weight jamais sorti. 2 800 milliards de paramètres. Contexte d'un million de tokens. Et un outil de coding MIT qui permet de le brancher dans votre terminal. La vraie question : est-ce que ça coupe l'herbe sous le pied d'Anthropic, ou juste du marketing bien huilé ?
Un million de tokens dans le terminal. Ça change quoi, concrètement ?
Commençons par les faits bruts, parce que les chiffres sont suffisamment spectaculaires pour parler d'eux-mêmes.
Kimi K3, sorti le 16 juillet 2026, tourne en Mixture-of-Experts : 896 experts au total, 16 activés par token. 2 800 milliards de paramètres en tout — soit 75% de plus que DeepSeek V4 Pro qui était jusqu'ici le record du monde en open-weight. La fenêtre de contexte : 1 048 576 tokens. Un million. Soit cinq fois Claude Opus 4.7.
Sur OpenRouter, le tarif : 3 dollars par million de tokens en entrée, 15 dollars en sortie. Claude Fable 5 coûte 10 et 50. GPT-5.6 Sol : environ 15 et 60. K3 est trois fois moins cher que Claude et cinq fois moins cher qu'OpenAI sur les mêmes tâches.
Et aujourd'hui, Moonshot publie les poids complets. Ce n'est plus un service cloud opaque. C'est un modèle que vous pouvez faire tourner vous-même.
Maintenant, la question honnête : est-ce que ça code bien ?
Sur Terminal-Bench 2.1, K3 marque 88,3. Sur FrontierSWE : 81,2. Sur l'Arena Frontend Code (vote humain), il est numéro un avec 1 679 points. Artificial Analysis lui donne un score d'intelligence de 57,1 — derrière Claude Fable 5 (60) et GPT-5.5 Sol (59), mais la différence de prix rend la comparaison absurde.
Il manque le score SWE-bench Verified classique — Moonshot ne l'a pas publié, et c'est un drapeau rouge. Claude Fable 5 est à 95% sur ce benchmark. Kimi K3 évite soigneusement la comparaison directe.
Kimi Code CLI : un vrai produit, pas une démo
Kimi Code CLI n'est pas un gadget. C'est un agent de codage en terminal écrit en TypeScript, distribué via npm, sous licence MIT. Vous l'installez, vous le branchez sur votre projet, et il lit, modifie, exécute des commandes shell, cherche sur le web, planifie. Comme Claude Code, mais avec un modèle open-weight et un code source qu'on peut auditer.
L'architecture est solide. Trois sous-agents natifs : coder (développement général), explore (lecture seule pour cartographier une codebase sans rien casser), plan (architecture sans exécuter de commandes). Un système de plugins avec manifest JSON. Un support MCP (Model Context Protocol). Des hooks pour valider avant commit. Et — point important — un support multi-provider : vous pouvez brancher Anthropic, OpenAI ou Google dessus, ce n'est pas une prison dorée.
L'Agent Swarm mérite une mention particulière. Jusqu'à 300 agents parallèles sur K2.5 et au-dessus. Dans les faits : Moonshot dit que K3 a généré un jeu multijoueur complet "pour quelques dollars", et construit MiniTriton, un compilateur GPU dans le style de Triton. Difficile à vérifier indépendamment, mais le fait que l'architecture supporte 300 agents en parallèle n'est pas une promesse marketing — c'est documenté dans le code source.
Comparé à Claude Code, Kimi Code a un avantage structurel net : le modèle est open-weight, le CLI est open-source MIT, et il supporte d'autres providers. Claude Code vous enferme dans l'écosystème Anthropic. Kimi Code non.
Pourquoi Moonshot veut vous donner ça "presque gratuitement"
Il y a un truc bizarre avec le plan Adagio (gratuit) de Kimi Code. 300 appels API par fenêtre de 5 heures. Un modèle open-weight disponible en self-hosting. Un CLI MIT.
Moonshot n'est pas une ONG. Ils ont levé... rien de public en financement institutionnel récent, contrairement à Anthropic et ses 7 milliards. Ce sont les géants du web chinois qui financent indirectement l'écosystème — Alibaba Cloud et les partenariats asiatiques.
La stratégie est limpide : gagner des parts de marché en Europe et aux États-Unis avant que les régulateurs ne se réveillent. L'open-weight est un cheval de Troie : il rend l'adoption indolore ("c'est ouvert !"), et crée une dépendance à l'écosystème Kimi pour les abonnements payants une fois que les équipes sont embarquées.
C'est exactement ce que Meta a fait avec Llama. Et ça marche.
Les problèmes réels, parce qu'il y en a
La communauté est brutalement honnête dans les GitHub Issues.
Le metering est opaque. Un utilisateur sur le plan Allegro à 99 dollars par mois a vidé son quota en une semaine d'utilisation normale. Le passage du "token metering" au "task quota" casse toute prédictibilité de coût. L'Issue #1381 est explicite : "Allegro à $99 performe moins bien qu'un concurrent gratuit sur certaines tâches." Moonshot n'a pas répondu publiquement.
Sur Windows, Git Bash est obligatoire. Pas de shell natif. C'est une friction significative pour les équipes Windows, et en 2026, beaucoup d'équipes enterprise tournent encore sous Windows.
Les agents customs (--agent et --agent-file) sont en mode expérimental, disponibles uniquement avec KIMI_CODE_EXPERIMENTAL_FLAG=1 et uniquement en mode kimi -p, pas dans le TUI interactif. Ce qui veut dire que la feature la plus intéressante — créer des agents sur mesure — n'est pas encore stable pour un usage quotidien.
Et puis il y a la question qui fâche : les données passent par des serveurs en Chine. Moonshot AI est une startup pékinoise. Pour les équipes européennes soumises au RGPD, c'est un problème réel, pas une paranoïa. Vous pouvez configurer manuellement un provider local, mais ça demande de la configuration et de l'expertise. Par défaut, vos prompts et votre code vont chez Moonshot.
Claude Code vs Kimi Code : le match chiffré
Critère | Kimi Code | Claude Code |
Modèle par défaut | Kimi K3 / K2.7 Code | Claude Opus / Fable 5 |
Licence CLI | MIT (open-source) | Propriétaire |
Modèle open-weight | Oui (K3, K2.7) | Non |
Multi-provider | Oui | Non |
Contexte max | 1M tokens | 200K tokens |
Agent Swarm | Jusqu'à 300 agents | Agent teams (nb non documenté) |
Prix API | $3/$15 par M tokens | $10/$50 par M tokens |
Plan gratuit | Oui (300 appels/5h) | Non |
Prix Max | $199/mois | $200/mois |
SWE-bench Verified | Non publié | ~95% (Fable 5) |
Terminal-Bench 2.1 | 88,3 | Non publié |
Sur le papier, Kimi Code gagne sur le prix, le contexte, l'open-weight, et la multi-provider. Claude Code gagne probablement sur la performance pure (le SWE-bench à 95% de Fable 5 n'est pas anodin) et sur la confiance de la chaîne de données.
Pour une startup qui cherche à réduire ses coûts de dev IA et dont les données ne sont pas critiques — Kimi Code mérite une évaluation sérieuse. Pour une équipe enterprise avec des contraintes de conformité — Claude Code reste le choix par défaut, pas par supériorité technique mais par localisation des données.
K2.7 Code dans GitHub Copilot : le coup silencieux
Il y a un détail du dossier que j'ai failli passer : depuis juillet 2026, Kimi K2.7 Code est disponible comme modèle dans GitHub Copilot.
GitHub Copilot, c'est plusieurs millions de développeurs. Pas des early adopters de HackerNews — des développeurs en entreprise, dans des ESN, chez des grands comptes. Moonshot a réussi à faire intégrer leur modèle dans le produit Microsoft le plus utilisé dans le dev enterprise.
C'est l'équivalent de placer un produit dans tous les Monoprix du pays. Discret, efficace, et potentiellement massif.
Verdict
Kimi Code et K3 sont de vrais produits, pas du marketing. Le CLI est propre, l'architecture multi-agents est solide, et les benchmarks (ceux qu'ils publient) sont compétitifs. Le prix est agressif. L'open-weight est une promesse tenue.
Mais les problèmes de billing opaque, le metering imprévisible à $99/mois, et la question des données en Chine ne disparaissent pas parce que le CLI est sur npm.
Pour les développeurs qui veulent un coding agent pas cher et puissant, avec un contexte qu'aucun concurrent ne propose : testez Kimi Code. Le plan Adagio est gratuit. Vous n'avez rien à perdre.
Pour les équipes avec des données sensibles et des obligations RGPD : continuez de payer $200/mois à Anthropic. Parfois le prix n'est pas seulement pour le modèle — c'est pour savoir où va votre code.
La guerre des coding agents en 2026, c'est une guerre à trois fronts : performance, prix, et confiance. Sur les deux premiers, Moonshot est dans la course. Sur le troisième, ils ont encore du boulot.
Sources
- Documentation officielle Kimi Code — https://www.kimi.com/code/docs/
- GitHub MoonshotAI/kimi-code — https://github.com/MoonshotAI/kimi-code
- Kimi K3 Tech Blog — https://www.kimi.com/blog/kimi-k3
- OpenRouter — Kimi K3 (tarifs) — https://openrouter.ai/moonshotai/kimi-k3
- BenchLM — Kimi K3 (79,98/100) — https://benchlm.ai/models/kimi-3
- Kimi Code Plans et Agent Swarm — https://www.codeagentswarm.com/en/guides/kimi-code-plans-and-pricing
- GitHub Issue #1381 — performance Allegro — https://github.com/MoonshotAI/kimi-code/issues/1381
- Forum Moonshot — Bug billing — https://forum.moonshot.ai/t/kimi-code-2-6-major-bug/379
- UsageBox — Token Metering vs Task Quotas 2026 — https://usagebox.com/articles/token-metering-vs-task-quotas-2026-claude-code-kimi-code
- Artificial Analysis — Kimi K3 Intelligence Index — https://artificialanalysis.ai
- NxCode — K3 Benchmarks — https://www.nxcode.io/resources/news/kimi-k3-benchmarks-coding-agent-evaluation-guide-2026
- Kimi K2.7 Code — Release — https://www.kimi.com/resources/kimi-k2-7-code-pricing
💡 Idée d'illustration : Terminal noir avec deux fenêtres côte à côte — à gauche le logo Claude (orange anthropic), à droite le logo Kimi (violet moonshot). Entre les deux, un drapeau chinois pixelisé et un symbole open-source. Style néobrutaliste, police monospace, fond très sombre. Ambiance guerre froide tech.

