Moore Threads dévoile un supercalculateur IA de 256 GPU
D'après TechNode (21 juillet 2026 à 09h56)
Résumé
Le chinois Moore Threads a présenté au WAIC 2026 son système MTT C256, qui relie 256 GPU en une unité de calcul de taille data center à latence sub-microseconde.
Les faits
Moore Threads, développeur chinois de GPU, a présenté son système MTT C256 lors de la World Artificial Intelligence Conference (WAIC) 2026. Ce système relie 256 GPU pour former une seule unité de calcul à l'échelle d'un centre de données. Le MTT C256 s'appuie sur un réseau Scale-up monocouche permettant une communication « tous vers tous » entre les 256 cartes. L'ensemble est intégré dans deux baies standards, ce qui en fait une solution de calcul à haute densité. Moore Threads affirme que ce réseau monocouche atteint une latence de communication inférieure à la microseconde entre les GPU. Le constructeur insiste sur le fait que cette performance d'interconnexion est au cœur de l'efficacité de la plateforme pour l'entraînement et l'inférence de grands modèles. Sur le plan applicatif, la société a également démontré l'entraînement d'un modèle mélange d’experts de 236 milliards de paramètres, utilisant plus de 25 000 milliards de tokens. Cette démonstration vise à illustrer la capacité du MTT C256 à soutenir des scénarios de calcul intensif pour les très grands modèles de langage.
Pourquoi c’est important
En agrégeant 256 GPU dans une seule unité de calcul avec un réseau Scale-up monocouche et une latence inférieure à la microseconde, Moore Threads cherche à lever un des verrous majeurs des grands modèles : l’efficacité de la communication entre cartes. Cette architecture vise à offrir une puissance de calcul de type data center dans seulement deux baies standards, ce qui en fait une proposition de valeur forte pour les centres de calcul d’IA. La démonstration d’un modèle mélange d’experts de 236 milliards de paramètres, entraîné sur plus de 25 000 milliards de tokens, montre que le MTT C256 se positionne directement sur le segment des très grands modèles. En mettant l’accent sur l’interconnexion « tous vers tous » et la latence sub-microseconde, Moore Threads se place dans la course aux infrastructures optimisées pour l’entraînement massif, un enjeu stratégique clé pour l’écosystème des GPU et des plateformes d’IA.
Questions fréquentes
Qu’est-ce que le système MTT C256 de Moore Threads ?
C’est un système qui relie 256 GPU pour former une unité de calcul à l’échelle d’un centre de données.
Combien de GPU le MTT C256 peut-il relier ?
Le MTT C256 relie 256 GPU dans un seul système de calcul.
Quelle architecture réseau utilise le MTT C256 ?
Il utilise un réseau Scale-up monocouche pour une communication tous vers tous entre les 256 cartes.
Dans combien de racks le MTT C256 est-il hébergé ?
Le système est hébergé dans deux racks standards.
Quel type de modèle Moore Threads a-t-il entraîné avec le MTT C256 ?
Un modèle mélange d’experts de 236 milliards de paramètres, entraîné sur plus de 25 000 milliards de tokens.
Source
TechNodeAuteur
Rédaction IA-MediasRédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.