Moonshot a mis en ligne les poids ouverts de Kimi K3, son modèle le plus capable, soit 2,8 trillions de paramètres que n’importe qui peut désormais télécharger gratuitement. Le fichier pèse 1,4 To en quantification MXFP4, ce qui en fait la plus grosse publication en poids ouverts de l’histoire, et Kimi K3 devient au passage le premier modèle libre à mener un grand benchmark de code long.
Pour résumer
- Les poids de Kimi K3 sont téléchargeables gratuitement, 2,8 trillions de paramètres pour 1,4 To de fichiers.
- Le modèle signe 42 sur SWE Marathon, devant Fable 5 et GPT-5.6 Sol, une première pour un modèle ouvert.
- L’API reste facturée 3 $ par million de tokens en entrée et 15 $ en sortie, mais le poids libre change tout le calcul.
Faire résumer cet article par une IA
ChatGPTLe plus gros modèle libre jamais publié tient en 1,4 To
La bascule est nette. Moonshot avait d’abord annoncé Kimi K3 sans livrer les poids, une retenue déjà visible quand le laboratoire avait coupé les ventes de Kimi faute de GPU disponibles. Les poids sont maintenant publics, et le modèle passe du statut d’API fermée à celui de brique que chacun peut héberger.
Les chiffres donnent l’échelle. Kimi K3 embarque 2,8 trillions de paramètres, une fenêtre de contexte d’un million de tokens, une vision native et un mode de réflexion réglable en effort. Le paquet complet pèse 1,4 To grâce à la quantification MXFP4, un format qui compresse les poids sans casser la qualité, et les fichiers sont hébergés sur la page officielle du laboratoire chez Hugging Face.
Ce n’est pas un premier essai. Kimi K3 avait déjà fait parler de lui quand le modèle ouvert talonnait les meilleurs systèmes américains, mais les poids restaient hors de portée. La publication d’aujourd’hui referme cet écart d’accès, et elle arrive dans un été chinois déjà dense côté modèles libres.
Le contexte compte. Le camp chinois pousse fort sur l’ouvert, un mouvement amorcé quand Alibaba avait sorti Qwen 3.8, son plus gros modèle, et Kimi K3 place désormais la barre de taille au-dessus de tout le reste.
42 sur SWE Marathon, une première pour un modèle ouvert
Le score qui fait basculer le récit est celui de SWE Marathon, un test de code sur tâches longues. Kimi K3 y obtient 42, au-dessus de Fable 5 à 35 et de GPT-5.6 Sol à 39. Pour la première fois, un modèle libre mène un grand benchmark de code à horizon long, un terrain que les modèles fermés dominaient sans partage.
Les autres relevés confirment le niveau. Le modèle marque 67,5 avec l’agent maison KimiCode et 67,3 avec le harnais mini-SWE-agent, deux mesures qui jugent la capacité à mener une tâche de bout en bout. Les testeurs indépendants d’Artificial Analysis le classent quatrième sur 189 modèles, avec un indice de 57, tout en haut du peloton ouvert.
Pour une équipe qui construit, l’intérêt n’est pas le podium mais l’indépendance. Un modèle de ce calibre qu’on héberge soi-même retire la dépendance à une API tierce, le contrôle des données remonte côté client, et le coût marginal d’un appel tombe à celui de l’électricité GPU. C’est un arbitrage que chaque acteur relançait déjà quand DeepSeek V4 remplaçait ses anciens modèles pour tirer les prix vers le bas.
La nuance tient au matériel. Faire tourner 2,8 trillions de paramètres exige un parc GPU sérieux, hors de portée d’un poste isolé. Le poids libre profite donc surtout aux hébergeurs, aux clouds spécialisés et aux grands comptes qui internalisent, pas encore au développeur seul sur sa machine.
D’autres articles sur Horizon
- ChatGPT Voice pilote votre ordinateur à la voix
- Claude Opus 5 rivalise avec le top de l’IA à moitié prix
- Gemini frôle le milliard d’utilisateurs mensuels
Un plancher de prix qui force OpenAI et Anthropic
Un modèle de pointe gratuit à héberger ne reste pas une affaire chinoise. Il installe un plancher de prix que les modèles fermés doivent regarder en face, puisqu’un client peut toujours comparer une facture d’API au coût d’un déploiement maison. L’API de Kimi K3 reste pourtant payante, à 3 $ le million de tokens en entrée et 15 $ en sortie, avec 0,30 $ pour l’entrée en cache.
La pression vise d’abord le haut de gamme fermé. OpenAI et Anthropic vendent la capacité au token, et un rival libre qui mène un benchmark de code réduit leur marge de manœuvre sur le tarif. Chaque lab doit désormais justifier son prix par autre chose que la seule qualité brute, aujourd’hui la fiabilité, l’écosystème ou la sécurité.
Le camp ouvert, lui, se densifie vite. Kimi K3 arrive après une vague de sorties libres, au moment où Zhipu lançait un rival de Claude en accès libre, et l’addition de ces modèles finit par constituer une alternative crédible pour qui veut sortir des API américaines. Le prochain signal à surveiller est la réaction tarifaire des labos fermés dans les semaines qui viennent.
Reste la question de la souveraineté des données. Héberger un modèle chinois en local rassure sur la fuite vers une API étrangère, mais déplace le débat vers l’audit du modèle lui-même. C’est le genre d’arbitrage que les directions techniques vont trancher au cas par cas, et Kimi K3 leur en donne désormais les moyens.
Affaire à suivre sur Horizon.


