OpenAI dévoile sa puce pour une IA moins chère

D'après OpenAI (25 août 2026 à 09h05)

Résumé

OpenAI expose une stratégie intégrée, des puces aux data centers, pour délivrer une intelligence artificielle plus utile, plus rapide et à moindre coût.

Les faits

OpenAI présente une stratégie de calcul conçue comme « un système intégré » couvrant centres de données, puces, modèles de pointe, plateforme développeurs, produits grand public et entreprise, ainsi que des appareils natifs IA, chaque couche renforçant les autres. L’entreprise insiste sur le fait que des logiciels plus performants rendent le matériel plus productif et que des modèles plus capables débloquent de meilleurs produits, qui génèrent à leur tour demande, usage et apprentissage. La société dévoile les premiers résultats mesurés de Jalapeño, sa première puce d’inférence personnalisée. Sur InferenceX, un benchmark public utilisant GPT‑OSS 120B, Jalapeño affiche « plus de débit de pointe par kilowatt et une latence de jeton plus faible » que les systèmes commerciaux comparés, et des performances solides sur DeepSeek R1 et Kimi K2, ce qui montre que ses gains s’étendent à plusieurs familles de modèles. OpenAI souligne que développer ensemble le modèle, le logiciel de service, la puce, la mémoire et le réseau permet d’améliorer simultanément débit, latence, efficacité énergétique et coût, tout en offrant une voie « first‑party » crédible aux côtés des accélérateurs de ses partenaires. Pour gérer la diversité des charges — entraînement de frontière, inférence à haut volume, agents toujours actifs — OpenAI dit vouloir rester « sur la frontière de Pareto », en recherchant en permanence le meilleur compromis entre capacité, vitesse, fiabilité, efficacité et coût. Microsoft et les puces NVIDIA sont présentés comme « fondamentaux » pour sa croissance, complétés aujourd’hui par un portefeuille incluant AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy et SoftBank, chacun apportant des atouts spécifiques en infrastructure cloud, calcul accéléré, inférence à faible latence, développement de data centers et fourniture d’énergie. OpenAI met aussi en avant la capacité de ses centres de données à créer de la valeur économique et locale. Le projet Camellia en Géorgie est décrit comme un exemple de site conçu autour des besoins des clients, créant des emplois, soutenant les entreprises locales, finançant l’infrastructure du projet et les coûts énergétiques, tout en conservant l’eau grâce à un système en boucle fermée et en soumettant ses engagements à un audit public indépendant annuel.

Pourquoi c’est important

OpenAI relie explicitement la performance technique à la valeur économique. L’entreprise affirme que « la valeur de ce système se mesure à ce qu’il produit : une intelligence plus utile pour chaque unité de calcul ». Elle décrit comment de meilleurs modèles, un routage plus intelligent, une gestion optimisée du contexte, des logiciels améliorés et un matériel conçu pour l’inférence se traduisent par des gains de vitesse, d’efficacité énergétique et de fiabilité, ainsi que par une réduction du coût total du travail réussi pour les clients. OpenAI illustre ces gains avec l’Artificial Analysis Coding Agent Index, où GPT‑5.6 Sol en mode raisonnement maximal atteint un nouveau sommet tout en utilisant « 54 % de jetons de sortie en moins qu’un autre modèle de premier plan ». La société mobilise le paradoxe de Jevons pour expliquer que cette IA plus capable et abordable rend économiquement praticables de nouveaux usages, comme l’analyse personnalisée pour chaque client, l’examen systématique de tous les contrats, la simulation financière en temps réel ou le test de davantage d’idées d’ingénierie. Dans sa vision, une « avance composée » se crée : une technologie meilleure entraîne de meilleurs fondamentaux économiques, qui financent la prochaine vague de recherche, d’infrastructure et de sécurité, renforçant l’ensemble du système à chaque cycle.

Questions fréquentes

Comment OpenAI décrit sa stratégie de calcul pour l’IA ?

OpenAI parle d’un « système intégré » couvrant data centers, puces, modèles, plateforme développeurs, produits et appareils natifs IA, chaque couche renforçant les autres.

Qu’est-ce que Jalapeño pour OpenAI ?

Jalapeño est la première puce d’inférence personnalisée d’OpenAI, conçue avec le modèle, le logiciel de service, la mémoire et le réseau pour optimiser débit, latence, efficacité et coût.

Sur quel benchmark OpenAI mesure Jalapeño ?

OpenAI indique avoir testé Jalapeño sur InferenceX, un benchmark public utilisant GPT‑OSS 120B, où la puce surpasse des systèmes commerciaux en débit par kilowatt et en latence.

Quels partenaires d’infrastructure OpenAI cite‑t‑elle ?

OpenAI mentionne Microsoft, NVIDIA, AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy et SoftBank, chacun avec des forces spécifiques en cloud, calcul et énergie.

Quel rôle joue le projet Camellia en Géorgie ?

OpenAI présente Project Camellia comme un data center conçu autour des besoins clients, créant des emplois, soutenant les entreprises locales et utilisant un système en boucle fermée pour l’eau.

Source

OpenAI

Auteur

Rédaction IA-Medias

Rédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.