NVIDIA lance Magpie TTS, des agents vocaux multilingues à faible
Avec Magpie TTS Multilingual, NVIDIA propose un modèle open-weights, 12 langues et contrôle complet du déploiement pour bâtir des agents vocaux.
Dernières actualités Recherche publiées par IA-Medias.
Avec Magpie TTS Multilingual, NVIDIA propose un modèle open-weights, 12 langues et contrôle complet du déploiement pour bâtir des agents vocaux.
Ai2 lance TutorMoments, un cadre d’évaluation qui mesure si des modèles savent aider un élève au bon moment, sans lui retirer l’effort d’apprendre.
La Banque mondiale estime que l’IA peut aider les pays en développement à gagner un siècle de progrès en dix ans, s’ils comblent vite leurs déficits essentiels.
WeatherNext de Google DeepMind améliore d’un jour l’anticipation des cyclones tropicaux, atteint un niveau de pointe et devient désormais open source.
Baseten devient un fournisseur pris en charge sur Hugging Face Hub, avec un accès serverless aux modèles conversationnels et de génération de texte.
Une revue de 89 articles montre que la presse du livre couvre largement l’IA, mais reste centrée sur le droit d’auteur et néglige les capacités techniques.
LiquidAI dévoile LFM2.5-2.6B, un modèle agentique de 2,6 milliards de paramètres conçu pour exécuter des agents complets sur appareils locaux, rapides, privés et sans cloud.
Google DeepMind lance Gemini Robotics ER 2, un modèle de « raisonnement incarné » qui améliore la compréhension vidéo, l’orchestration de tâches et la collaboration multi-robots.
Google lance Lyria 3.5 dans Flow Music, son nouveau modèle de génération musicale, avec des avancées sur la musicalité, les paroles, les voix et le contrôle créatif.
L’Allen Institute for AI déploie la plateforme OlmoEarth pour faire passer ses modèles d’observation de la Terre de la phase de fine-tuning à l’inférence massive, à coût ultra rédu
NVIDIA présente Cosmos-H-Dreams, un simulateur génératif conditionné par les actions, capable de tourner en temps réel sur un seul GPU RTX PRO 6000 et de boucler avec un contrôleur
Le développeur chinois DeepSeek, à l’origine du modèle de raisonnement open source R1, place la recherche en intelligence artificielle générale devant plateformes grand public et r
Google DeepMind annonce 40 millions de dollars de jetons et crédits cloud pour la Genesis Mission, avec AlphaEvolve, AlphaFold 3 et Gemini for Government.
Hugging Face présente Grabette, un système ouvert et peu coûteux pour enregistrer des démonstrations de manipulation « à la main » et les transformer en jeux de données prêts pour
Google dévoile trois nouveaux modèles Gemini optimisés pour les agents IA à grande échelle : 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber, plus efficaces et moins coûteux.
NVIDIA NeMo Automodel s’intègre à Diffusers pour entraîner et affiner à grande échelle des modèles texte‑image et texte‑vidéo du Hub, sans conversion de checkpoints.
Une revue de 239 études montre que l’IA pour la stimulation cérébrale profonde des troubles du mouvement progresse, mais reste freinée par un manque de validation externe.
NVIDIA annonce Nemotron 3 Embed, une famille de modèles d’embedding dont Nemotron-3-Embed-8B-BF16 atteint la première place globale sur le benchmark RTEB.
Hugging Face dévoile une intrusion limitée dans son infrastructure, orchestrée par un système d’agents IA autonomes, et détaille les mesures de remédiation et de protection.
Shippy, agent maritime d’Ai2 intégré à Skylight, montre comment concevoir des agents IA fiables : séparation « âme », compétences et config, outils déterministes et hébergement iso
Zhipu AI va lancer un plan « Touch High » centré sur la recherche AGI, avec quatre priorités techniques et un accent sur la sécurité.
Hugging Face publie le troisième volet de sa série sur le profiling dans PyTorch et montre comment l’attention se lit dans le profiler, du naïf aux backends optimisés.
Anthropic dévoile le « J-space », un ensemble de motifs neuronaux internes dans Claude qui soutient le raisonnement, la modulation de pensées et la résolution de problèmes en plusi
Hugging Face et Amazon SageMaker AI lancent une intégration en un clic : les modèles sélectionnés ouvrent directement les workflows SageMaker Studio.
Hugging Face Storage devient un backend natif de SkyPilot, permettant de lancer des workloads IA sur n’importe quel cloud tout en stockant modèles et données sans egress.
Microsoft ajoute une collection de modèles Hugging Face à Foundry Managed Compute, offrant un déploiement en un clic avec sécurité et gouvernance d’entreprise.
Avec LeRobot v0.6.0, Hugging Face veut boucler la boucle de l’apprentissage robotique en combinant imagination, évaluation par récompense et amélioration continue des politiques.
Hugging Face annonce de « major updates » pour 🤗 Kernels, avec un nouveau type de dépôt dédié sur le Hub et un renforcement de la sécurité des kernels.
Une revue systématique montre que des modèles d’IA appliqués aux lames histologiques H&E peuvent prédire la réponse aux thérapies néoadjuvantes avec des performances prometteuses.
Google DeepMind dévoile Nano Banana 2 Lite, modèle d’images ultra-rapide et économique, et rend Gemini Omni Flash accessible aux développeurs pour la génération et l’édition vidéo.
Dharma-AI défend la spécialisation comme principe central des systèmes d’IA, en s’appuyant sur une synthèse théorique et empirique couvrant biologie, marchés et apprentissage autom