Baseten sécurise les modèles IA face aux attaques
D'après TechCrunch (17 septembre 2026 à 19h15)
Résumé
Baseten et son unité de recherche Base Labs lancent avec Hugging Face et Goodfire AI un cadre de sécurité intégré pour évaluer et surveiller les modèles d’IA à poids ouverts.
Les faits
Baseten a lancé mercredi un nouveau standard d’infrastructure de sécurité, en s’appuyant sur son groupe de recherche Base Labs et en nouant un partenariat avec Hugging Face et Goodfire AI. L’objectif est de bâtir une infrastructure d’évaluation et de surveillance de la sécurité spécifiquement conçue pour les modèles à poids ouverts. Ce lancement intervient dans un contexte de débat croissant sur la sécurité des modèles à poids ouverts, fragilisés par une technique d’attaque émergente baptisée « abliteration » qui permet de retirer leurs garde‑fous. L’ampleur du phénomène est illustrée par Hugging Face, qui héberge des modèles d’IA open source et recense actuellement plus de 6 000 modèles abliterés. Base Labs, groupe de recherche créé plus tôt cette année par Baseten, doit développer et publier des méthodes de formation et de surveillance pour les modèles ouverts. L’entreprise présente ces travaux comme un « standard » pour les modèles ouverts, pensé pour être transparent et intégré dès la phase d’entraînement et de déploiement, plutôt qu’ajouté a posteriori. Baseten défend une approche où l’ouverture devient un levier de sécurité. « Nous pensons que l’ouverture est un avantage pour la sécurité de l’IA », indique la société sur X, en soulignant que l’ouverture offre davantage de visibilité sur le comportement des modèles et surtout de meilleures possibilités de transformer la recherche en sécurité en contrôles concrets et transparents, par contraste avec les approches propriétaires.
Pourquoi c’est important
Ce partenariat positionne Baseten, Base Labs, Hugging Face et Goodfire AI au cœur de la réflexion sur la sécurité des modèles d’IA à poids ouverts, alors que la pratique de l’« abliteration » remet en cause l’efficacité des garde‑fous classiques. En cherchant à intégrer la sécurité dans les méthodes d’entraînement et dans l’infrastructure de déploiement, le projet vise à déplacer la sécurité de l’IA du statut de couche additionnelle vers celui de composant structurel des modèles ouverts. L’initiative illustre aussi le rôle central des plateformes d’hébergement et des spécialistes de l’interprétabilité pour encadrer l’usage des modèles open source, dans un paysage où plus de 6 000 modèles abliterés sont déjà recensés. En appelant plus largement l’écosystème des développeurs à contribuer à ce cadre, Baseten et Base Labs cherchent à fédérer un effort collectif pour rendre les modèles ouverts à la fois accessibles et sûrs.
Questions fréquentes
Quel est l’objectif du partenariat lancé par Base Labs ?
Développer une infrastructure d’évaluation et de surveillance de sécurité pour les modèles d’IA à poids ouverts.
Pourquoi la sécurité des modèles à poids ouverts est-elle jugée problématique ?
Une technique appelée « abliteration » permet de retirer leurs garde‑fous, rendant ces modèles potentiellement dangereux.
Combien de modèles abliterés sont actuellement listés sur Hugging Face ?
Hugging Face recense plus de 6 000 modèles abliterés hébergés sur sa plateforme.
Comment Baseten décrit-il le travail de Base Labs ?
Comme un « standard » pour les modèles ouverts, transparent et intégré à l’entraînement et au déploiement plutôt qu’ajouté après coup.
Pourquoi Baseten considère l’ouverture comme un avantage pour la sécurité de l’IA ?
Selon l’entreprise, l’ouverture offre plus de visibilité sur le comportement des modèles et facilite des contrôles de sécurité concrets et transparents.
Source
TechCrunchAuteur
Rédaction IA-MediasRédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.