Le tournant Coinbase IA chinoise est officialisé par Brian Armstrong. Les équipes consomment plus de tokens que jamais sur GLM 5.2 et Kimi 2.7, mais la facture totale est tombée à environ la moitié de ce que les modèles occidentaux coûtaient.
Pour résumer
- Brian Armstrong confirme la bascule sur GLM 5.2 et Kimi 2.7, deux modèles chinois, pour la majorité des charges IA.
- 91 % des développeurs Coinbase n’ont jamais saturé leurs anciennes limites, signe que la migration n’a contraint personne.
- Le hit cache passe de 5 à 60 %, et le routing automatique par tâche, prix et reuse fait le reste de la baisse.
Faire résumer cet article par une IA
ChatGPTBrian Armstrong annonce la bascule
Le PDG de Coinbase a confirmé publiquement le virage Coinbase IA chinoise sur ses réseaux sociaux. L’entreprise route désormais l’essentiel de ses charges IA vers GLM 5.2 et Kimi 2.7, deux modèles édités par des labs chinois.
Le chiffre central tient en une phrase. Coinbase consomme plus de tokens que jamais, et paie environ la moitié de ce qu’elle payait avec les fournisseurs occidentaux. La courbe d’usage continue de grimper côté développeurs sans que la courbe budgétaire suive.
L’argument anti-friction est aussi mis en avant. 91 % des développeurs Coinbase n’ont jamais saturé leurs anciennes limites mensuelles, ce qui veut dire que la bascule n’a coûté aucune productivité visible. Personne n’est venu plaider pour le retour des modèles US au nom d’un usage bridé.
Le contexte Coinbase pèse dans la décision. Le groupe sort d’une période où il a multiplié les positions structurantes côté infrastructure, notamment sur la menace quantique pesant sur 7 millions de bitcoins, et la sensibilité au coût d’infrastructure y est devenue un réflexe.
L’annonce d’Armstrong n’est pas un manifeste politique. C’est une décision d’opérateur, prise après benchmark, et qui se présente comme un constat budgétaire. Mais elle envoie un signal lourd au reste du marché.
Routing par tâche, cache 5 % à 60 % : la cuisine technique
La bascule de Coinbase ne se résume pas à un changement de fournisseur. L’équipe a mis en place un routing automatique qui sélectionne le modèle en fonction de la tâche, du prix au token et du potentiel de cache.
Le gain le plus parlant est sur le cache. Le hit rate est passé de 5 à 60 %, ce qui veut dire qu’une majorité des requêtes ne touchent plus le modèle distant et sont servies depuis une réponse déjà payée. À volumes constants, ce seul levier divise les coûts par un facteur que peu d’optimisations LLM atteignent.
Coinbase a aussi décidé de rendre la consommation visible côté dev, sans imposer de cap dur. Chaque équipe voit ce qu’elle dépense, et la dépense doit se justifier par un impact business chiffré. L’effet est culturel autant que technique, l’usage IA y devient un poste rendu compte plutôt qu’une commodité invisible.
Le routing par tâche fait basculer le débat. Le marché entier s’était habitué à choisir un modèle premium par défaut. Coinbase rappelle qu’une part importante des tâches en production tient parfaitement avec un modèle moyen, à condition d’orchestrer la sélection en amont.
Le résultat opérationnel suggère que la dépendance aux labs occidentaux était en partie une dépendance par confort. Un orchestrateur bien construit ouvre brutalement l’éventail des fournisseurs acceptables.
À voir également sur Horizon :
- Sondage Anthropic : Claude fait la moitié de votre job
- Biais politique IA : seul Gemini reste équilibré
- Mythos relance : Trump rouvre l’accès à 100 acteurs US
Le pricing chinois met OpenAI et Anthropic sous tension
À court terme, le mouvement Coinbase IA chinoise pèse sur les négociations contractuelles en cours chez OpenAI et Anthropic. Quand un acteur de cette taille publie une baisse de moitié, chaque client enterprise a un argument neuf face à son commercial.
D’autres entreprises occidentales ont déjà fait le pas. Lindy a basculé sur DeepSeek v4 selon son PDG, et Snowflake teste les modèles chinois comme alternative directe à OpenAI et Anthropic. La preuve de concept Coinbase risque d’accélérer la liste.
L’arrivée de GLM 5.2 et Kimi 2.7 dans les stacks de production occidentaux confirme aussi une tendance qui se dessine depuis plusieurs mois. MiniMax M3 avait déjà ouvert la voie en battant GPT-5.5 sur certains benchmarks ouverts, sans le tampon d’un lab américain.
À moyen terme, sur trois à six mois, la guerre des prix entre OpenAI et Anthropic devient mécanique. GPT-5.6-Sol a déjà été positionné par OpenAI comme une réponse en ratio tokens face aux variantes Claude, et les acteurs chinois jouent maintenant le rôle du tiers qui force la baisse.
Reste l’angle politique. Les modèles chinois restent à distance des juridictions américaines, et toute administration peut décider du jour au lendemain de fermer la porte. Mais tant que le différentiel de prix tient, le calcul Coinbase IA chinoise reste arithmétiquement défendable, et chaque CFO occidental le sait.
Affaire à suivre sur Horizon.


