
d-Matrix adopte NVLink Fusion de Nvidia pour ses puces d'inférence IA Raptor
- Actus
- Rocks on Galaxy
- Tech
- 11 Sep, 2026
- 0
Le spécialiste de l'inférence IA d-Matrix a annoncé le 10 septembre une collaboration avec Nvidia : ses prochaines puces Raptor s'intégreront aux racks de serveurs Nvidia grâce à la technologie NVLink Fusion.
NVLink Fusion : brancher ses puces sur l'usine IA de Nvidia
NVLink Fusion est la plateforme de Nvidia qui permet à des fabricants tiers d'intégrer leurs puces (XPU) directement dans son écosystème de data centers. D'après Nvidia, elle offre une latence XPU-à-XPU 3 fois plus faible que l'Ethernet classique, des taux de paquets 10 fois plus élevés, et 3 To/s de bande passante all-to-all par XPU via le NVLink de 6e génération.
Raptor, une puce dédiée à l'inférence
Raptor est une puce d'inférence « centrée mémoire », conçue dès l'origine pour NVLink Fusion et le rack MGX de Nvidia. Elle est en cours d'évaluation chez des hyperscalers et des laboratoires d'IA, et s'appuie sur plus de 100 brevets. Son tape-out (finalisation de la conception) est attendu avant fin 2026.
Une disponibilité en 2027
Les premières disponibilités des XPU Raptor intégrés au rack MGX de Nvidia sont attendues au quatrième trimestre 2027. La demande en calcul d'inférence explose à mesure que les modèles d'IA passent de l'entraînement à l'usage quotidien — le marché que vise d-Matrix, face aux GPU de Nvidia qui dominent l'entraînement.