Baseten rejoint Hugging Face, booste l'IA serverless
D'après Hugging Face (6 août 2026 à 02h00)
Résumé
Baseten devient un fournisseur pris en charge sur Hugging Face Hub, avec un accès serverless aux modèles conversationnels et de génération de texte.
Les faits
Hugging Face annonce que Baseten est désormais un « supported Inference Provider » sur le Hugging Face Hub. L’intégration élargit l’écosystème serverless disponible directement sur les pages de modèles du Hub. L’intégration est aussi disponible dans les SDK clients de Hugging Face, en JavaScript comme en Python, afin de permettre l’utilisation de nombreux modèles avec des fournisseurs différents. Dans cette première phase, Baseten prend en charge les tâches conversationnelles et de génération de texte sur Hugging Face. Le billet cite notamment des modèles open-weight comme Kimi K3, DeepSeek V4 Flash et GLM-5.2. Hugging Face indique aussi que d’autres tâches seront ajoutées prochainement. Le billet renvoie enfin vers le compte Baseten sur Hugging Face.
Pourquoi c’est important
Cette annonce renforce la logique de distribution de l’IA par couches d’infrastructure plutôt que par modèles isolés. En ajoutant Baseten aux Inference Providers, Hugging Face élargit les options d’exécution serverless accessibles depuis le Hub, ce qui simplifie le passage du modèle à l’usage. L’intérêt stratégique est aussi dans la portée développeur. L’intégration dans les SDK Python et JavaScript réduit les frictions d’adoption, tandis que la prise en charge de tâches conversationnelles et de génération de texte donne immédiatement une valeur pratique sur des modèles open-weight déjà populaires.
Questions fréquentes
Que change l’arrivée de Baseten sur Hugging Face ?
Baseten devient un fournisseur d’inférence pris en charge sur le Hub, avec une utilisation serverless directement sur les pages de modèles.
Quels SDK sont concernés ?
Les SDK clients de Hugging Face en JavaScript et en Python.
Quels types de tâches Baseten prend-il en charge au lancement ?
Les tâches conversationnelles et de génération de texte.
Quels modèles sont cités dans le billet ?
Kimi K3, DeepSeek V4 Flash et GLM-5.2.
Source
Hugging FaceAuteur
Rédaction IA-MediasRédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.