Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Retour au blog

Test Kimi K2.7 Code : faut-il passer depuis K2.6 ?

Kimi K2.7 Codetest KimiIA codingAgentmodele de code

Oui, Kimi K2.7 Code est bien sorti. Plus précisément, Moonshot a publié et open sourcé Kimi K2.7 Code le 12 juin 2026. Ce n'est pas un remplaçant universel de K2.6. C'est un modèle plus ciblé sur le coding et les workflows agentiques.

J'ai relu la documentation officielle, la liste des modèles, les pages de prix et les premiers retours chinois autour du lancement. Mon verdict est simple : si votre usage principal est le code, le travail sur un dépôt long contexte ou les appels d'outils en plusieurs étapes, K2.7 Code mérite un vrai test. Si vous cherchez un modèle plus polyvalent pour des tâches mixtes, K2.6 reste aujourd'hui le choix le plus sûr.

TL;DR

  • Kimi K2.7 Code a été lancé et open sourcé le 12 juin 2026.
  • Ce n'est pas "K2.6 en mieux sur tout". C'est une branche spécialisée coding.
  • Moonshot met en avant une meilleure adhérence aux consignes en long contexte, de meilleurs résultats sur les tâches de programmation longues, et environ 30 % de tokens en moins en moyenne.
  • Le contexte reste à 256K, avec prise en charge du texte, des images et de la vidéo.
  • La réflexion est toujours activée. On ne peut pas la désactiver comme sur K2.6.
  • Moonshot indique lui-même que K2.6 reste préférable pour les tâches non liées au code.

Ce qui change vraiment avec Kimi K2.7 Code

Le positionnement officiel est très clair :

  • modèle de code le plus fort de Kimi à ce jour
  • fenêtre de contexte 256K
  • optimisé pour les tâches logicielles longues
  • appels d'outils et raisonnement multi-étapes
  • entrées texte, image et vidéo
  • thinking toujours actif
  • poids ouverts pour l'évaluation et le déploiement local

Autrement dit, ce n'est pas une mise à jour pensée pour "mieux discuter". C'est une mise à jour pensée pour tenir la route dans un vrai contexte projet, avec plus de mémoire et moins de dérive.

Les trois points les plus intéressants

1. Le vrai sujet, c'est la fiabilité sur les tâches longues

Le signal le plus important n'est pas "il écrit du code plus joli". C'est le fait que Moonshot parle surtout de suivi d'instructions en long contexte et de réussite sur les tâches de programmation de longue durée.

Dans la vraie vie, le plus difficile n'est pas d'écrire 20 lignes propres. Le plus difficile est :

  • garder les contraintes déjà définies
  • ne pas casser la logique existante
  • fermer correctement une modification sur plusieurs fichiers

De ce point de vue, K2.7 Code semble plus intéressant qu'une simple hausse de benchmark.

2. Il a l'air plus pertinent pour les workflows Agent

Moonshot insiste sur le tool calling, le reasoning et les tâches agentiques. Les notes de lancement chinoises mentionnent aussi environ 10 % de gain sur des benchmarks comme Kimi Claw 24/7 Bench, MCP Atlas et MCP Mark Verified.

Cela compte si votre équipe ne "chatte" plus seulement avec un modèle, mais lui demande réellement de :

  • lire un repo
  • inspecter des fichiers
  • proposer un patch
  • appeler un CLI
  • lancer des tests
  • poursuivre selon le résultat

Dans ce type de boucle, moins d'erreurs de direction valent souvent plus qu'un petit gain sur un test one-shot.

3. Le rapport prix / performance reste crédible

D'après les prix publics de Moonshot, l'entrée et la sortie standards restent alignées avec K2.6, tandis que l'entrée en cache-hit baisse. La page anglaise affiche actuellement Cache Hit $0.19 / 1M, Input $0.95 / 1M, Output $4.00 / 1M. Le canal chinois donne l'équivalent 1,3 CNY / 1M en cache-hit, 6,5 CNY / 1M en entrée, 27 CNY / 1M en sortie.

Le message est donc plutôt sain : garder un niveau de prix voisin, améliorer le coding et l'agent, et réduire les tokens de réflexion gaspillés.

Là où je freinerais l'enthousiasme

Version directe : K2.7 Code a l'air solide, mais je ne le vendrais pas encore comme le nouveau roi universel.

1. Il est meilleur en coding, pas forcément meilleur partout

Ce n'est pas une interprétation prudente de ma part. Moonshot dit explicitement que K2.6 reste recommandé pour les tâches non-coding.

Si votre charge ressemble surtout à :

  • du chat généraliste
  • de la rédaction non technique
  • de la compréhension multimodale légère
  • des échanges rapides où le thinking toujours actif n'est pas utile

alors K2.6 peut encore rester le meilleur point de départ.

2. Thinking toujours actif = avantage et coût

kimi-k2.7-code n'autorise pas le mode non-thinking. C'est un bon point pour les tâches complexes, mais pas forcément pour tous les appels en production.

Il faut toujours regarder :

  • la latence
  • le budget token
  • le routage des requêtes
  • les cas où un modèle plus léger suffit

3. Les vrais projets comptent plus que le benchmark du jour 1

Les benchmarks de lancement sont utiles, mais les modèles de code brillent souvent le jour de l'annonce avant de se heurter à la réalité des dépôts existants.

Le bon test n'est pas "peut-il coder Snake". Le bon test est :

  • corriger un bug dans votre base de code
  • finir une feature sur plusieurs fichiers
  • diagnostiquer une erreur à partir de logs
  • tenir 30 à 60 minutes de workflow agentique

Qui devrait l'essayer maintenant

Bon candidat tout de suite

  • équipes déjà sur K2.6, Claude Code, Cline ou RooCode
  • développeurs qui travaillent avec du long contexte et des changements multi-fichiers
  • équipes à la recherche d'un modèle coding / agent moins cher
  • environnements mixtes chinois / anglais

Peut attendre

  • usage surtout orienté chat ou rédaction
  • tâches trop courtes pour justifier 256K de contexte
  • forte sensibilité à la latence du thinking
  • absence de workflow agentique réel

Comment je ferais le test

Je ne remplacerais rien à l'aveugle. Je ferais plutôt :

  1. 3 à 5 tâches réelles de votre backlog.
  2. Une comparaison contre K2.6 et votre modèle principal actuel.
  3. Un suivi de quatre métriques : taux de réussite, nombre de reprises, total de tokens, temps mur.
  4. Un test volontaire des appels d'outils multi-étapes.
  5. Une montée en charge seulement si le modèle est vraiment plus stable ou moins coûteux chez vous.

Pour un essai rapide via une API unifiée :

Verdict final

Ma conclusion tient en une phrase :

Kimi K2.7 Code n'est pas une mise à niveau universelle de K2.6. C'est une montée en gamme plus nette, plus spécialisée, et plus orientée coding.

C'est justement pour cela qu'il mérite d'être évalué sérieusement.

FAQ

Kimi K2.7 Code est-il vraiment sorti ?

Oui. Moonshot indique que Kimi K2.7 Code a été publié le 12 juin 2026.

Quelle est la plus grande différence entre K2.7 Code et K2.6 ?

Le positionnement. K2.7 Code est centré sur le coding et les agents ; K2.6 reste plus polyvalent.

Kimi K2.7 Code est-il multimodal ?

Oui. La documentation officielle mentionne le support du texte, des images et de la vidéo.

Peut-on désactiver le thinking sur Kimi K2.7 Code ?

Non. kimi-k2.7-code ne prend pas en charge le mode non-thinking.