OpenAI dévoile Jalapeño, sa puce IA plus rapide et efficace

D'après TechCrunch (25 août 2026 à 16h22)

Résumé

OpenAI a dévoilé Jalapeño au Hot Chips, avec des résultats initiaux montrant davantage de tokens par utilisateur et plus de débit par kilowatt que les meilleurs systèmes d’inférence actuels.

Les faits

Au Hot Chips, mardi, OpenAI a présenté une vue plus détaillée de Jalapeño, en publiant les premiers résultats de benchmark du système. Testée sur InferenceX, le benchmark de SemiAnalysis, la puce a affiché davantage de tokens par utilisateur et un débit supérieur par kilowatt que les processeurs d’inférence actuellement considérés comme les plus avancés. Richard Ho, responsable matériel chez OpenAI, a déclaré lors d’un appel presse que « les résultats montrent une avancée de performance très, très significative par rapport à l’état de l’art ». Il a ajouté que Jalapeño peut « servir davantage de travail IA par unité de puissance, tout en renvoyant les réponses plus rapidement », et qu’elle est « très efficace pour servir beaucoup de clients », tout en pouvant aussi être « très faible en latence ». La comparaison est faite avec un système Nvidia Blackwell, mais OpenAI souligne que la concurrence pourrait avoir progressé d’ici le déploiement complet. Richard Ho a estimé que Jalapeño serait déployée à la fin de 2026 « en très petits volumes », avec un déploiement plus important attendu en 2027. OpenAI indique que Jalapeño a été développée en étroite collaboration avec Broadcom, avec l’aide de ses propres modèles pour le processus de développement. L’entreprise veut en faire une plateforme multi-génération, où produits, modèles, puces et mémoire seraient développés de concert, notamment pour réduire les délais de préremplissage et de communication qui créent souvent des goulets d’étranglement dans le traitement de l’inférence.

Pourquoi c’est important

Jalapeño marque une étape stratégique pour OpenAI, qui ne se contente plus de concevoir des modèles, mais cherche aussi à maîtriser une brique critique de l’infrastructure d’IA : la puce d’inférence. En mettant en avant à la fois le débit par kilowatt et la latence, l’entreprise cible deux des principaux arbitrages économiques des déploiements à grande échelle. Le choix d’une conception « full-stack » avec Broadcom montre aussi que la bataille de l’IA se joue désormais autant dans le matériel que dans les modèles. Si Jalapeño tient ses promesses en production, OpenAI pourrait améliorer ses coûts d’exécution et son efficacité énergétique, deux paramètres devenus centraux dans l’exploitation industrielle des systèmes d’IA.

Questions fréquentes

Jalapeño a-t-elle été testée sur un benchmark public ?

Oui. OpenAI dit l’avoir testée sur InferenceX, le benchmark de SemiAnalysis.

Quels résultats OpenAI met-elle en avant ?

La puce a obtenu davantage de tokens par utilisateur et plus de débit par kilowatt que les processeurs d’inférence actuels les plus avancés.

Avec qui Jalapeño a-t-elle été développée ?

OpenAI indique l’avoir développée en étroite collaboration avec Broadcom.

Quand le déploiement est-il attendu ?

OpenAI estime un déploiement à la fin de 2026 en très petits volumes, puis un déploiement plus important en 2027.

Source

TechCrunch

Auteur

Rédaction IA-Medias

Rédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.