Kimi K3 : le plus gros modèle IA ouvert talonne les US

Kimi K3, le plus gros modèle IA ouvert, gravit un sommet enneigé face aux labos américains

Moonshot AI a publié le 16 juillet Kimi K3, un modèle de 2 800 milliards de paramètres présenté comme le plus gros modèle en poids ouverts jamais diffusé. À sa sortie, il se hisse à la troisième place du classement Artificial Analysis, derrière Claude Fable 5 et GPT-5.6 Sol, mais il devance tout le monde sur le code frontend. La Chine vient de réduire l’écart avec les laboratoires américains à quelques semaines.

Pour résumer

  • Kimi K3 pèse 2 800 milliards de paramètres en poids ouverts, avec une diffusion complète des poids prévue le 27 juillet
  • Il domine le banc Frontend Code Arena avec 76 % de préférence face à Claude Fable 5, à 15 $ le million de tokens contre 50 $
  • Sa sortie a coïncidé avec le discours de Xi Jinping au World AI Conference et un repli des valeurs de puces à Wall Street

Faire résumer cet article par une IA

ChatGPT

Ce que Moonshot a réellement livré

Kimi K3 est un modèle à mélange d’experts. L’architecture n’active que 16 de ses 896 experts par token, soit environ 1,8 % du réseau à chaque calcul, ce qui permet de faire tourner 2 800 milliards de paramètres sans allumer l’ensemble à chaque requête. Moonshot le décrit comme le premier système ouvert de la classe des 3 000 milliards.

Le modèle embarque une fenêtre de contexte d’un million de tokens et une vision native, capable de traiter texte et images dans le même échange. Moonshot a détaillé ces caractéristiques dans la présentation technique publiée sur son site officiel, avant même l’ouverture complète des poids.

Le mot compte : ouverts. Moonshot prévoit de diffuser les poids de K3 le 27 juillet, ce qui laissera les développeurs télécharger, inspecter et exécuter le modèle eux-mêmes. Jusque-là, il reste accessible uniquement via l’interface et l’API du laboratoire.

Le positionnement dans les classements dessine deux images différentes. Sur le baromètre généraliste Artificial Analysis, K3 sort troisième, derrière Fable 5 et GPT-5.6 Sol. Sur Arena, il prend la première place du banc de code frontend avec 76 % de préférence en test à l’aveugle, et il inscrit 88,3 au Terminal-Bench 2.1. Sur le web et le mobile, il propose trois niveaux d’effort de raisonnement, Standard, High et Max.

Ce profil rappelle une trajectoire déjà engagée côté chinois, quand Zhipu lançait un rival de Claude en accès ouvert avec GLM-5.2. Kimi K3 pousse la même logique un cran plus loin, en taille et en performance sur une tâche précise.


Kimi K3

Impact utilisateurs : le code frontend d’abord

Pour les développeurs, le signal le plus net vient d’Arena. En test à l’aveugle, les développeurs ont préféré Kimi à tous les grands modèles américains sur le développement web frontend, y compris Fable 5 et GPT-5.6 Sol. La capacité ne recouvre pas tout le champ du code, mais elle touche un cas d’usage quotidien des équipes produit.

Le prix accompagne le message. K3 facture 15 $ le million de tokens en sortie, soit environ trois fois moins que les 50 $ de Fable 5. Il reste plus cher que d’autres modèles chinois, GLM-5.2 à 4,40 $ et DeepSeek V4 à 0,87 $, mais il se place nettement sous les modèles frontière américains équivalents.

L’ouverture des poids change la nature de l’offre. Une équipe pourra héberger K3 sur son infrastructure, l’auditer et l’adapter, sans dépendre du serveur d’un éditeur. Ce point sépare un modèle propriétaire d’un modèle qu’une entreprise contrôle de bout en bout, un argument que les autres laboratoires chinois exploitent déjà, comme DeepSeek qui lève 1,5 milliard et prépare son entrée en Bourse.

La contrepartie tient au calendrier. Tant que les poids ne sont pas publiés, personne ne peut vérifier indépendamment le modèle ni le faire tourner en local. Le 27 juillet départagera la promesse de la disponibilité réelle, comme souvent avec les annonces de modèles.


D’autres articles sur Horizon


Impact concurrence : Wall Street et la course US-Chine

La sortie de K3 a coïncidé avec le discours de Xi Jinping au World AI Conference de Shanghai. Le rapprochement de calendrier n’a pas échappé aux marchés : le Nasdaq a reculé d’environ 1 % vendredi, les investisseurs allégeant les valeurs de puces comme Nvidia. Un modèle ouvert de niveau frontière venu de Chine touche directement la thèse d’une avance américaine durable.

La pression se déplace sur les prix. Avec Fable 5 à 50 $ et un modèle ouvert trois fois moins cher juste derrière sur une tâche visible, les laboratoires américains perdent une partie de leur marge de manœuvre tarifaire. Le différenciant se réduit à l’écart de quelques semaines mesuré par les classements généralistes.

Le débat sur la portée réelle du modèle reste ouvert. Dean Ball, responsable de la stratégie chez OpenAI, a reconnu que Kimi était un très bon modèle dont la performance ne s’explique pas par une simple distillation. D’autres voix tempèrent, en pointant l’absence de capacités cyber dangereuses et les incitations chinoises à encadrer, à terme, ses propres modèles ouverts.

Derrière le modèle, Moonshot avance vite. Le laboratoire a levé environ 2 milliards de dollars à une valorisation proche de 20 milliards, et prépare une cotation à Hong Kong. Kimi K3 lui sert de démonstration publique, à un moment où la question n’est plus de savoir si la Chine suit, mais de combien de semaines.

Notre lecture reste prudente jusqu’au 27 juillet. Un classement de code frontend ne fait pas un modèle universel, et l’ouverture des poids apportera le vrai verdict d’usage. Le reste de la course se jouera là, sur ce que les développeurs feront tourner chez eux.

Affaire à suivre sur Horizon.

Comments

No comments yet. Why don’t you start the discussion?

    Laisser un commentaire

    Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *