Baseten rejoint Hugging Face en tant que fournisseur d'inférence, mettant les modèles d'IA populaires à la disposition de plus de développeurs

Les développeurs peuvent désormais exécuter des modèles d'IA à poids ouvert via Baseten directement depuis le Hub Hugging Face, sans majoration des coûts et avec deux options de facturation parmi lesquelles choisir.

AI2Day Newsdesk3 min read
Close-up, 16:9, photoreal news-editorial photograph of a compact square mechanical keyboard pad with frosted translucent keys glowing in multiple colours, green
Share

Points clés

  • Hugging Face a ajouté Baseten comme fournisseur d'inférence pris en charge sur son Hub de modèles, annoncé en 2025.
  • Baseten prend initialement en charge les tâches conversationnelles et de génération de texte, incluant des modèles tels que Kimi K3 et DeepSeek V4 Flash.
  • Les abonnés Hugging Face PRO reçoivent 2 dollars de crédits d'inférence mensuels utilisables auprès de tous les fournisseurs, y compris Baseten.
  • Les développeurs peuvent s'authentifier avec un seul jeton Hugging Face ; Hugging Face achemine automatiquement la demande vers Baseten.
  • Hugging Face ne facture aucune majoration sur les demandes acheminées, répercutant les coûts des fournisseurs aux tarifs standard.

Hugging Face, la plateforme où les chercheurs et les entreprises partagent des modèles d'IA, a ajouté Baseten à sa liste de fournisseurs d'inférence. Un fournisseur d'inférence est un service qui exécute réellement un modèle d'IA et retourne un résultat. Avant ce changement, les développeurs qui voulaient utiliser des modèles hébergés sur Baseten devaient le configurer séparément. Désormais, ils peuvent le faire directement à partir de la page du modèle Hugging Face.

Baseten est une entreprise d'infrastructure IA. Considérez-la comme une plateforme qui gère tout le travail serveur pour qu'un développeur puisse appeler un puissant modèle d'IA, comme un grand modèle de langage (la technologie qui alimente les chatbots tels que ChatGPT), avec quelques lignes de code au lieu de gérer des ordinateurs lui-même.

Quels modèles sont disponibles maintenant ?

Au lancement, Baseten prend en charge les tâches de génération de texte et conversationnelles sur Hugging Face, y compris les modèles à poids ouvert, c'est-à-dire les modèles dont la conception sous-jacente est publiquement disponible. La sélection initiale comprend Kimi K3, DeepSeek V4 Flash et GLM-5.2. D'autres types de modèles arrivent bientôt.

Modèle Type Statut
Kimi K3 LLM à poids ouvert Disponible maintenant
DeepSeek V4 Flash LLM à poids ouvert Disponible maintenant
GLM-5.2 LLM à poids ouvert Disponible maintenant
Types de tâches supplémentaires Conversion texte-parole, autres Déploiement prévu bientôt

Comment fonctionne la facturation ?

Il y a deux options. Si vous fournissez votre propre clé API Baseten (un code privé qui identifie votre compte), les frais sont facturés directement sur votre compte Baseten. Si vous vous authentifiez via Hugging Face, le coût apparaît sur votre facture Hugging Face au tarif standard du fournisseur. Hugging Face n'ajoute aucune majoration.

Les abonnés Hugging Face PRO reçoivent 2 dollars de crédits d'inférence chaque mois, utilisables auprès de n'importe quel fournisseur pris en charge, y compris Baseten.

Les utilisateurs Hugging Face gratuits et connectés obtiennent un petit quota sans frais. Au-delà de cette limite, la mise à niveau vers PRO déverrouille les crédits et des limites d'utilisation plus élevées.

Pourquoi les utilisateurs ordinaires devraient-ils s'en soucier ?

Si vous créez des applications ou expérimentez avec des outils d'IA, cela importe : un compte, un jeton, accès à plusieurs fournisseurs sans jongler avec des clés API distinctes. Pour les personnes qui utilisent simplement des applications terminées, le changement est invisible mais peut améliorer discrètement la fiabilité, puisque les développeurs peuvent maintenant changer de fournisseur sans réécrire leur code.

L'intégration fonctionne également dans les outils d'agent IA, des logiciels qui peuvent exécuter des tâches en plusieurs étapes de manière autonome, tels que Pi, OpenCode et Hermes Agents, de sorte que les modèles exécutés sur Baseten s'intègrent automatiquement dans ces flux de travail.

Questions fréquemment posées

Ai-je besoin d'un compte Baseten pour essayer ceci ?

Non. Vous pouvez vous authentifier avec votre jeton Hugging Face et la demande achemine via Hugging Face. Un compte Baseten n'est nécessaire que si vous souhaitez utiliser votre propre clé API Baseten et facturer directement sur ce compte.

La bibliothèque Python ou JavaScript de Hugging Face est-elle compatible ?

Oui. La bibliothèque Python huggingface_hub version 1.26.1 ou supérieure et le package @huggingface/inference JavaScript prennent tous deux en charge Baseten depuis ce lancement.

© 2026 AI2Day