AMD accélère l'IA avec Cerebras

D'après Axios (23 juillet 2026 à 02h00)

Résumé

AMD et Cerebras vont répartir les charges d’inférence IA entre AMD Helios et les systèmes Cerebras, via Cerebras Cloud, pour gagner en vitesse et en efficacité.

Les faits

AMD a annoncé jeudi un partenariat avec la startup de puces IA Cerebras visant à permettre aux clients de répartir les charges d’inférence entre les systèmes des deux entreprises. L’objectif est de mieux traiter la phase d’inférence, qui transforme un modèle entraîné en réponse et conditionne la rapidité et le coût des services IA au quotidien. Selon l’accord, Cerebras prévoit de déployer des systèmes AMD Helios dans ses centres de données, avec une offre conjointe accessible via Cerebras Cloud plus tard dans l’année. Les puces AMD seront chargées du traitement des requêtes et des grandes fenêtres de contexte, tandis que les systèmes Cerebras accéléreront la génération de jetons, une étape fortement dépendante de la bande passante mémoire. Ce partenariat intervient peu après l’annonce par AMD d’Anthropic comme client majeur, dans un contexte de hausse continue de la demande en puissance de calcul pour l’IA. Plus tôt dans la semaine, AMD a confirmé un accord pour fournir jusqu’à 2 gigawatts de puissance de calcul à Anthropic, le premier gigawatt devant être mis en service en 2027, et s’est engagée à investir jusqu’à 5 milliards de dollars dans l’entreprise. La directrice générale d’AMD, Lisa Su, y voit le signe d’une évolution plus large des architectures IA vers une spécialisation des composants. Elle estime que l’IA pourrait contribuer à porter le marché mondial du calcul à 2 000 milliards de dollars d’ici 2030, incluant les serveurs de centres de données, les PC ainsi que divers appareils embarqués et de périphérie.

Pourquoi c’est important

L’accord entre AMD et Cerebras marque une étape clé dans l’émergence de solutions d’inférence IA « désagrégées », où différentes puces sont optimisées pour des phases distinctes du traitement. En confiant à AMD le prétraitement des requêtes et des contextes étendus, et à Cerebras la génération de jetons très gourmande en bande passante mémoire, les deux acteurs cherchent à améliorer simultanément la latence, le débit et les coûts d’exploitation des modèles. Ce mouvement intervient alors qu’AMD renforce rapidement sa présence dans l’écosystème IA, en nouant des partenariats lourds avec des acteurs comme Anthropic et en projetant un marché du calcul porté à 2 000 milliards de dollars à horizon 2030. La disponibilité de l’offre conjointe via Cerebras Cloud plus tard dans l’année pourrait offrir aux clients une nouvelle alternative aux plateformes existantes pour servir des modèles avancés, dans un contexte de compétition intense pour les ressources de calcul IA.

Questions fréquentes

Que prévoit le partenariat entre AMD et Cerebras ?

Il permet aux clients de répartir les charges d’inférence IA entre les systèmes AMD et ceux de Cerebras.

Comment sont réparties les tâches d’inférence IA ?

Les puces AMD traitent les requêtes et les grandes fenêtres de contexte, les systèmes Cerebras génèrent les jetons.

Où les systèmes AMD Helios seront-ils déployés ?

Cerebras prévoit de déployer les systèmes AMD Helios dans ses centres de données.

Quand l’offre conjointe AMD–Cerebras sera-t-elle disponible ?

Elle doit être proposée via Cerebras Cloud plus tard dans l’année.

Combien AMD investit-il dans Anthropic ?

AMD a convenu d’investir jusqu’à 5 milliards de dollars dans Anthropic.

Source

Axios

Auteur

Rédaction IA-Medias

Rédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.