OpenRouter dévoile que 45% du trafic IA va aux modèles chinois : ce que ça change pour votre stack marketing

OpenRouter : la bascule du trafic IA vers les modèles chinois
Un concentré de technologie au cœur des flux numériques. Ce cube futuriste symbolise la puissance du traitement des données.

Votre outil de génération de contenu tourne-t-il vraiment sur GPT-5.5 ou Claude Opus 4.8 ? Ou bascule-t-il en silence vers le modèle le moins cher disponible ? OpenRouter route les appels API vers plus de 300 modèles pour des milliers d’entreprises. La plateforme a mesuré que les modèles conçus en Chine (DeepSeek, Qwen, Kimi, GLM, MiniMax) dépassaient 45% du volume total de tokens consommés dès avril 2026, contre moins de 2% fin 2024. Si votre équipe utilise ChatGPT au feeling sans savoir quel modèle traite réellement chaque prompt, cette bascule vous concerne déjà.

Ce que mesurent les classements OpenRouter

La plateforme publie chaque semaine un classement par volume de tokens consommés, facturé à l’usage réel de chaque entreprise cliente. Bruno Digital documente cette bascule dans son rapport du 7 juillet 2026 : DeepSeek captait à lui seul 16,3% du trafic total fin juin 2026 et la part combinée des fournisseurs chinois dans le top 10 atteignait 44%. Claude d’Anthropic, lui, reculait de 29,1% à 13,3% en un an. Chez les entreprises américaines, cette part a grimpé à 63% la première semaine de juillet 2026, contre moins de 10% un an plus tôt. OfficeChai relève une évolution proche pour la période suivante.

Les modèles conçus en Chine ont capté plus de 45% du volume total de tokens consommés sur OpenRouter dès avril 2026, un an après avoir représenté moins de 2% de ce même trafic (Bruno Digital, 2026).

L’écart de prix qui explique la bascule

Le token cost pilote cette migration. DeepSeek V4 Flash facture 0,14 dollar par million de tokens en entrée et 0,28 dollar en sortie. Claude Opus 4.8 facture 5 dollars en entrée et 25 dollars en sortie, GPT-5.5 se situe à 5 dollars et 30 dollars. L’écart atteint 30 à 35 fois sur la sortie. Les scores de benchmark, eux, restent proches. MiniMax M2.5 facture 0,15 et 0,90 dollar par million de tokens (tarifs OpenRouter, 2026). Le modèle obtient 80,2% sur SWE-Bench Verified contre 80,8% pour Claude Opus 4.6, alors la référence du marché sur ce benchmark, un écart de qualité inférieur à un point pour un tarif 10 à 20 fois moindre (Dataconomy, 25 février 2026). Martin Casado, associé chez Andreessen Horowitz, estime qu’environ 80% des startups qui utilisent des stacks IA open source font tourner un modèle chinois en arrière-plan.

L'écart de prix qui explique la bascule

Comment votre stack route déjà (peut-être) vers ces modèles

Peu d’outils marketing appellent un modèle en direct. La plupart passent par une couche de routing : OpenRouter lui-même, un agent orchestré via un MCP server ou le paramètre « cost-optimized » d’un SaaS de génération de contenu. Cette couche choisit le provider au moment de l’appel, souvent selon un critère de coût ou de disponibilité, rarement selon l’origine du modèle. Flo Crivello, fondateur de l’assistant IA Lindy, a basculé 100% du trafic de sa startup vers DeepSeek-V4 en juin 2026. Il affirme que la quasi-totalité des fondateurs IA qu’il connaît envisagent la même bascule ou l’ont déjà faite (NPR, 15 juillet 2026). Même logique chez Airbnb : Brian Chesky a confirmé que l’entreprise s’appuyait sur le modèle Qwen d’Alibaba, jugé « rapide et pas cher » (Bloomberg, cité par NPR, 2026). Si votre outil expose un context window généreux et un tool use fiable à un tarif cassé, l’équipe produit ne se pose généralement pas la question du pays d’origine du modèle.

Un classement dominé par le code, loin du copywriting

La génération de code et l’usage agentique captent l’essentiel des tokens consommés sur la plateforme : cette catégorie est passée de 11% à plus de 50% du trafic total en 2025 (mêmes données Dataconomy). Les modèles chinois excellent sur ces tâches parce qu’ils ont été entraînés et évalués dessus en priorité, ce qui ne dit rien de leur qualité rédactionnelle en français. Qwen 3.7 Max se classe 5e sur l’AA Intelligence Index. Kimi K3 prend la première place du Frontend Code Arena : deux résultats qui parlent aux équipes produit, plus qu’aux équipes contenu.

RGPD et PIPL : ce que ça change pour une entreprise française

Un modèle chinois hébergé sur des serveurs situés en Chine relève de la loi chinoise sur la protection des données personnelles (PIPL), que la CNIL ne considère pas comme équivalente au RGPD. Tout transfert de données personnelles vers ce type d’infrastructure suppose des clauses contractuelles types (CCT). Depuis la publication du guide définitif de la CNIL sur l’analyse d’impact des transferts de données (AITD), une analyse documentée du niveau de protection réel côté destinataire est aussi requise. En 2026, les contrôles de la CNIL portent explicitement sur les transferts vers des modèles entraînés hors UE. Deux options concrètes permettent de garder l’écart de prix sans s’exposer. Signer les CCT avec un fournisseur qui les propose ou récupérer les poids ouverts que DeepSeek, Qwen, GLM et MiniMax publient pour les auto-héberger sur une infrastructure européenne.

Auditer votre stack en moins de 20 minutes

Ce constat se vérifie depuis votre propre configuration de routing, en cinq points. Aucune de ces vérifications ne nécessite un accès administrateur complet ni l’intervention de l’équipe technique : 15 à 20 minutes suffisent pour la plupart des stacks marketing actuelles.

  1. Ouvrez le tableau de bord de votre couche de routing (OpenRouter, LangChain ou le panneau d’administration du SaaS marketing) et listez les providers actifs sur les 30 derniers jours.
  2. Vérifiez si un paramètre auto-router est activé : s’il l’est, votre outil peut basculer vers n’importe quel modèle du pool sans notification à l’équipe.
  3. Contrôlez la présence de clauses contractuelles types ou d’un DPA dans le contrat de chaque provider actif, y compris les fournisseurs chinois éventuellement intégrés par défaut.
  4. Lancez un test comparatif sur un même prompt marketing en français, via 2 ou 3 modèles (GPT-5.5, Claude Opus 4.8, DeepSeek V4 Pro). Ce type de synthetic audience testing révèle vite les écarts de ton et les biais de traduction.
  5. Figez la décision dans un system prompt ou une policy de routing documentée, un CLAUDE.md ou équivalent, pour que toute l’équipe applique la même règle plutôt que de choisir au feeling.

La part de trafic chinois sur OpenRouter continuera de fluctuer semaine après semaine selon les annonces de nouveaux modèles. Vous devez savoir en permanence quel modèle traite vos prompts et sous quelles conditions contractuelles. Ouvrez votre tableau de bord de routing et vérifiez, ligne par ligne, quel provider a traité votre dernière campagne.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *