Alibaba lance Qwen 3.8, son plus gros modèle IA

Qwen 3.8 pesé sur une balance géante face au logo Alibaba orange dans un hall industriel

Alibaba a dévoilé Qwen 3.8, un modèle de 2 400 milliards de paramètres que ses équipes présentent comme ne devançant que Fable 5. C’est le premier modèle multimodal de la famille Qwen à franchir la barre des 1 000 milliards de paramètres, et il arrive vingt-quatre heures après la sortie de Kimi K3.

Pour résumer

  • Qwen 3.8 compte 2 400 milliards de paramètres et traite images, vidéos et documents.
  • Aucun résultat de benchmark n’a été publié à ce stade.
  • La preview est accessible à 10 % du prix standard, les poids ouverts sont annoncés sans date.

Faire résumer cet article par une IA

ChatGPT

Un modèle à 2 400 milliards de paramètres sans un seul benchmark

Alibaba a présenté Qwen 3.8 comme un modèle qui rejoint la frontière, en le positionnant juste derrière Fable 5 dans la hiérarchie actuelle. La revendication est forte. Elle arrive pourtant sans aucun tableau de résultats.

C’est la première anomalie de cette annonce. Un lab qui affirme talonner le meilleur modèle du marché publie en général les chiffres qui le prouvent, et le fait le jour même. Ici, l’équipe Qwen a annoncé la position avant la démonstration.

Le chiffre de 2 400 milliards de paramètres reste néanmoins parlant. Qwen 3.8 est le premier modèle multimodal de la maison à dépasser le trillion, et il ingère images, vidéos et documents dans le même flux.

Le contexte explique le calendrier. Moonshot venait de sortir Kimi K3 et ses 2 800 milliards de paramètres, un modèle que nous avons couvert la semaine dernière quand le plus gros modèle ouvert du moment est venu se frotter aux références américaines. Alibaba a répondu en vingt-quatre heures.

Cette cadence en dit long sur l’état du marché chinois. Deux labs sortent leur modèle le plus lourd à un jour d’intervalle, au moment précis où la conférence de Shanghai concentre l’attention internationale.

L’effet a d’ailleurs dépassé le cercle des développeurs. La sortie de Kimi K3 a fait reculer le Nasdaq d’environ 1 % sur des ventes de valeurs semi-conducteurs, signe que les marchés lisent désormais ces annonces comme des informations industrielles et plus comme des curiosités techniques.

Pour une équipe technique, l’absence de chiffres pose un problème pratique immédiat. Impossible d’estimer un coût par tâche, une latence ou un taux d’échec sans passer par ses propres tests, ce qui reporte sur le client le travail d’évaluation que le lab n’a pas publié.


Qwen 3.8

La preview à 10 % du prix, une arme commerciale avant les poids

L’accès à Qwen 3.8 passe par une preview facturée à 10 % du prix standard, distribuée via le Token Plan d’Alibaba ainsi que Qoder et QoderWork. La remise est massive et assumée.

Pour une équipe produit, l’arbitrage se pose en termes simples. Un modèle multimodal de cette taille à un dixième du tarif habituel rend testable ce qui ne l’était pas, notamment sur les charges vidéo qui restaient hors budget chez la plupart des fournisseurs.

La contrepartie tient en un mot. Sans benchmark, personne ne sait aujourd’hui ce que vaut réellement le modèle sur du raisonnement long ou du code, et une preview subventionnée ne dit rien du prix à terme.

Les poids ouverts sont annoncés, sans date. Tant qu’ils ne sont pas publiés, Qwen 3.8 reste un modèle propriétaire accessible par API, et la promesse d’ouverture fonctionne surtout comme un signal envoyé à la communauté.

Alibaba n’en est pas à son premier geste politique sur ce terrain. Le groupe avait déjà coupé l’accès de ses propres salariés à Claude Code pour pousser ses outils maison, une décision qui dessinait la même logique de souveraineté logicielle.

Le mouvement d’ensemble se lit mieux en vidéo, et le basculement d’acteurs occidentaux vers les modèles chinois pour des raisons de coût est justement ce que raconte ce format court sur le choix de Coinbase.

Le calendrier de publication des poids devient donc la vraie variable. Tant qu’il reste flou, une équipe qui construit sur Qwen 3.8 accepte de dépendre d’une API dont le tarif promotionnel peut évoluer sans préavis, avec un coût de sortie qui grimpe à mesure que l’intégration avance.

Le multimodal change aussi la nature du calcul. Traiter la vidéo consomme bien plus de ressources que le texte, et une remise de cette ampleur sur ce type de charge peut déplacer des projets entiers qui dormaient dans les cartons faute de budget d’inférence.


D’autres articles sur Horizon


Ce que la riposte à Kimi K3 change pour les labs occidentaux

Deux modèles au-dessus de deux mille milliards de paramètres en deux jours, tous les deux chinois, tous les deux annoncés avec une promesse d’ouverture. Le rythme d’annonce est devenu une arme en soi.

Pour les labs occidentaux, la pression ne porte plus sur la capacité brute. Elle porte sur le prix, et une preview à un dixième du tarif standard installe une référence tarifaire que les clients garderont en tête au moment de renégocier.

Le précédent existe déjà. Un modèle chinois ouvert avait franchi cette frontière quand MiniMax M3 était passé devant GPT-5.5 en accès libre, et l’épisode avait montré combien un rapport qualité-prix agressif déplace vite les usages.

Reste la question que personne ne peut trancher aujourd’hui. Sans chiffres publiés et sans poids disponibles, la position revendiquée derrière Fable 5 est une affirmation commerciale, pas un résultat vérifiable.

Il y a un précédent immédiat à cette prudence. Kimi K3 a été annoncé avec des scores, et les mêmes chiffres ont montré une avance nette sur le code frontend accompagnée d’un décrochage sévère sur les mathématiques complexes. Un modèle peut dominer un classement et rester inutilisable sur la tâche qui compte pour vous.

Côté offre, la conséquence la plus concrète touche la structure des grilles tarifaires. Quand deux modèles de très grande taille arrivent en preview subventionnée la même semaine, le prix de référence du marché baisse avant même que la qualité soit tranchée.

Les prochaines semaines apporteront la réponse par l’usage. Les équipes qui branchent Qwen 3.8 sur leurs charges réelles produiront les comparaisons que le lab n’a pas fournies, et c’est à ce moment que la revendication tiendra ou tombera.

Affaire à suivre sur Horizon.

Comments

No comments yet. Why don’t you start the discussion?

    Laisser un commentaire

    Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *