Alibaba a annoncé la prise en charge native de son modèle d’IA Qwen-3.8 par sa puce XuanTie C950, basée sur l’architecture RISC-V et gravée en 5 nm. Ce développement permet d’exécuter des modèles de langage de 27 milliards de paramètres sans recourir à des couches d’émulation ni à des processeurs graphiques tiers.

Alibaba a annoncé que son modèle d’IA Qwen-3.8 27B, un modèle ouvert de 27 milliards de paramètres, pouvait désormais s’exécuter nativement sur son processeur maison XuanTie C950. Cette intégration s’inscrit dans une stratégie de verticalisation similaire à celle déployée par NVIDIA, visant à renforcer l’écosystème propriétaire du groupe chinois.
Présenté en mars 2026, le XuanTie C950 est un processeur 64 bits basé sur l’architecture open-source RISC-V, conçu pour des charges de travail d’IA en périphérie (edge computing). Contrairement aux solutions reposant sur des GPU, ce composant intègre directement des moteurs d’accélération matricielle et vectorielle, éliminant le besoin d’unités graphiques dédiées.
Caractéristiques techniques du XuanTie C950
Le processeur compte 64 cœurs répartis en clusters de 8, interconnectés via un bus haute vitesse AMBA CHI. Sa fréquence peut atteindre 3,2 GHz. Parmi ses spécificités :
- Une architecture RISC-V évitant les frais de licence liés aux architectures x86 ou ARM, avec une personnalisation accrue.
- Un décodage simultané de 8 instructions par cycle.
- Un pipeline à 16 étages, optimisé pour équilibrer vitesse d’horloge et exécution de tâches complexes.
- Une gestion mémoire incluant des caches L1 et L2 configurables, un cache L3 partagé en option, et des algorithmes de préchargement intelligent des données.
- Une exécution native des modèles d’IA, sans couche d’émulation, grâce à des extensions d’instructions dédiées.

Fabriqué selon le procédé 5 nm de TSMC (bien qu’Alibaba n’ait pas confirmé officiellement ce détail), le XuanTie C950 se distingue par son approche monothread par socket, le rendant plus adapté aux déploiements en périphérie ou aux inférences privées qu’aux API publiques à haute concurrence.
Intégration avec Qwen-3.8 27B
Le modèle Qwen-3.8 27B, capable de fonctionner avec 32 Go de VRAM, affiche des performances comparables à celles d’Opus 4.5 en matière de codage, tout en restant compatible avec des machines comme un MacBook. Sur le XuanTie C950, il atteint une vitesse de décodage de 30 tokens par seconde, avec un temps de réponse initial (Time To First Token) de 1,9 seconde.
Cette compatibilité native permet à Alibaba de consolider son écosystème en proposant une solution clé en main, combinant matériel et logiciel. Le groupe peut ainsi coupler le C950 avec d’autres accélérateurs dans ses centres de données pour optimiser les tâches d’inférence.
L’objectif sous-jacent reste une intégration verticale accrue, réduisant la dépendance aux acteurs externes tout en élargissant les options de déploiement pour ses clients. Une stratégie qui s’inscrit dans un marché chinois de l’IA particulièrement concurrentiel.